全球领先的企业级开源解决方案提供商红帽近日宣布,对红帽AI产
通过为开发者与运维人员提供统一框架,
什么是红帽AI 3.4?
红帽AI 3.4是一个综合性平台,
随着AI智能体推动推理需求呈指数级增长,红帽AI为企业提供了
为实现企业数据与模型、智能体的深度融合,红帽AI 3.4还新增提示词(prompt)管理能力,
为什么重要?
从实验性聊天机器人向生产级自主系统转型,需要IT团队之间的协
红帽AI 3.4面向可扩展推理与自主智能体部署,推出企业基础平台,
红帽及其合作伙伴的观点
红帽AI业务部副总裁兼总经理Joe Fernandes表示:“智能体时代意味着,
CoreWeave AI服务产品管理副总裁Urvashi Chowdhary表示:“CoreWeave与红帽的合作,
NVIDIA企业软件副总裁John Fanelli表示:“企业中自主化、长期运行的智能体,
主要亮点
- 可扩展的高性能推理,与受治理模型访问相结合:高效模型推理仍是
生产就绪型AI的核心。通过将vLLM推理服务器和llm-d分 布式推理引擎与MaaS相结合,红帽AI 3.4为模型推理提供了可靠且高性能的基础平台, 同时简化了用户和智能体对模型的受治理访问。 - 简化AgentOps,面向自主应用生命周期:红帽AI 3.4版本新增全面的AgentOps能力,
助力规模化智能体运维。功能涵盖集成式追踪、 可观测性和评估功能,同时提供智能体身份管理及生命周期管理, 从而推动智能体从开发到生产的顺利过渡。 - 打通数据、模型与智能体链路:企业数据是驱动模型与智能体运行的
核心要素。红帽AI 3.4 新增提示词管理功能,将提示词作为一级数据资产管理, 同时推出评估中心,可从质量、准确性、 安全性及风险维度统筹管理各类评估工作。上述能力由MLflow 提供支持,可为生成式AI与预测式AI/ML场景, 提供集成式实验追踪以及产物管理功能。 - 集成式模型与智能体安全防护:为助力保护整个AI堆栈,红帽AI
构建了分层安全防护体系,防护范围从操作系统延伸至智能体逻辑。 通过自动化安全测试与红队测试, 企业可采用数据驱动的方式完成模型及安全护栏的选型与配置, 更好地抵御不断演进的威胁,保障AI工作负载安全。
更多详情
- 高级推理与模型优化:红帽AI推理在其分布式推理能力中新增请求
优先级排序功能,可实现交互流量与后台流量共用同一端点, 高负载场景下优先处理时延敏感型请求。红帽AI推理还超越了红帽 OpenShift,扩展至其他Kubernetes服务,包括 CoreWeave和Azure, 为企业提供跨环境一致的推理堆栈。现已全面推出的投机解码(sp eculative decoding)支持,可在几乎不影响质量的前提下, 将响应速度提升2至3倍,同时降低单次交互成本。 - 受治理的模型即服务(MaaS):该功能支持平台工程师通过安全
增强型API端点,基于兼容OpenAI的标准接口交付经过验证 的精选模型,实现内部模型与外部API的统一治理, 并集成基于身份提供商(IDP)的身份认证。 - 集成式提示词管理:该平台提供统一工具,
将提示词作为一级数据资产进行构建和管理。 将驱动模型和智能体的输入存储在中央注册表中, 为开发者和管理员提供了单一数据源。 - 模型与智能体自动化评估:红帽AI 3.4推出评估中心,这是一套与框架无关的统一AI评估控制平面
,可对大语言模型(LLM)、AI应用及智能体开展评估。 该功能以统一的评估方式替代了碎片化测试方法,可以对质量、 准确性与风险水平进行基准测试。 - 多层安全防护:自动化对抗性扫描现已直接集成至开发生命周期中。
红帽AI平台依托Chatterbox Labs技术,采用Garak工具筛查模型与智能体系统存在的越 狱攻击、提示词注入、偏见等风险,并搭配NVIDIA NeMo Guardrails实现运行时安全防护。 - 生产级可观测性:通过集成MLflow,
实现对智能体执行过程的可视化监控,借助OpenTelemet ry完成LLM调用、推理步骤、工具执行、模型响应及token 使用情况的端到端追踪。为提示词、嵌入向量、RAG配置的全生命 周期建立透明审计轨迹,便于调试与审计工作。同时,MLflow 可为生成式AI与预测式AI场景提供集成式实验追踪以及产物管理 功能。 - 基于身份的治理:通过加密身份管理(SPIFFE/SPIRE)
,红帽AI使企业能够用短期Token取代静态硬编码密钥。 这支持整个堆栈中自主智能体的最小权限操作, 并有助于确保智能体行为与经过验证的身份相关联。 - 自动化体验:AutoRAG和AutoML等工具可自动化处理复
杂的AI任务,涵盖从为特定数据集选择最有效的检索策略, 到构建和优化传统预测模型等各个方面。 - 硬件灵活性与托管云:红帽AI 3.4提供对NVIDIA Blackwell GPU和AMD MI325X架构的零日支持。
通过将该统一平台架构扩展至在第三方托管云上原生运行——包括通 过全新的Red Hat AI Inference on IBM Cloud——红帽提供了跨多种硬件和云服务提供商的运营一致性 。
可用性
红帽AI 3.4 预计将于2026年5月晚些时候发布。
其他资源
- 阅读博客进一步了解 Red Hat AI 3.4
- 点击了解 Red Hat AI Inference on IBM Cloud
- 查看博客 Red Hat AI Inference on xKS
- 了解更多 MCP catalog
新闻摘要
红帽AI产
Mentioned in this article
Red Hat AI, Red Hat OpenShift AI
了解更多信息
- 阅读博客进一步了解 Red Hat AI 3.4
- 点击了解 Red Hat AI Inference on IBM Cloud
- 查看博客 Red Hat AI Inference on xKS
- 了解更多 MCP catalog
- 前瞻性陈述
除本文包含的历史信息和讨论外,本新闻稿中的陈述可能构成《1995年美国 Private Securities Litigation Reform Act(注:通常可不译,或译为:《1995年私人证券诉讼改革法案》)》中所界定的前瞻性陈述。前瞻性陈述是基于公司目前对未来业务和财务表现的假设。这些陈述涉及诸多风险、不确定性及其他因素,可能导致实际结果出现重大差异。本新闻稿中的任何前瞻性陈述仅在发布之日有效。除法律要求外,公司不承担更新或修订任何前瞻性陈述的义务。
###
Red Hat、Red Hat Enterprise Linux、Red Hat logo、JBoss、Ansible、Ceph、Gluster 和 OpenShift 是 Red Hat, LLC. 或其子公司在美国和其他国家/地区的商标或注册商标。Linux® 是 Linus Torvalds 在美国和其他国家/地区的注册商标。OPENSTACK logo和文字标记是 OpenInfra Foundation 的商标或注册商标,并经授权使用。