世界領先開放原始碼軟體解決方案供應商 Red Hat 今(13)日宣布 Red Hat AI 產品組合的重大進展,旨在弭平 AI 實驗階段與生產級營運控制之間的落差。
藉由提供建置人員與營運人員一致的框架,Red Hat 協助企業在擴展自主式系統基礎架構的同時,
Red Hat AI 事業部副總裁暨總經理 Joe Fernandes 指出:「AI 代理時代象徵著平台的進化,
Red Hat AI 3.4 為全方位平台,
隨著 AI 代理帶動對推論的指數級需求,Red Hat AI 賦能企業大規模部署與管理代理的能力,且不受代理框架的限制。
為了將企業資料與模型及代理相整合,Red Hat AI 3.4 導入提示詞管理(prompt management,將提示詞視為一等資料資產),
現階段 IT 團隊的協作方式亟需從根本性轉變,
為化解上述衝突,Red Hat AI 3.4 透過為可擴展推論與自主式代理部署提供企業基礎架構,
亮點功能
- 結合可擴展、高效能推論與受治理的模型存取:高效的模型推論仍是
生產就緒 AI 的核心。透過將 vLLM 推論伺服器、llm-d 分散式推論引擎與 MaaS 結合,Red Hat AI 3.4 為模型推論提供可靠且高效能的基礎, 同時簡化使用者與代理對受治理之模型的存取。 - 為自主式應用生命週期設計的精簡 AgentOps:Red Hat AI 3.4 導入全方位的 AgentOps 功能以協助大規模營運 AI 代理;包含整合式追蹤、可觀測性與評估功能,
以及代理身分與生命週期管理, 協助企業將代理從開發階段推向生產階段。 - 串連資料與模型及代理:企業資料是驅動模型與代理的關鍵燃料。R
ed Hat AI 3.4 新增提示詞管理(將提示詞視為一等資料資產), 以及用於管理品質、準確性、安全性與風險的評估中心。上述功能由 MLFlow 驅動,MLFlow 亦為生成式 AI 與預測式 AI/ML 應用情境提供整合式的實驗追蹤與工件管理。 - 兼顧模型與代理的整合安全防護:為保護整個 AI 堆疊,Red Hat AI 提供涵蓋從作業系統到代理邏輯的分層安全態勢(layered security posture)。透過提供自動化的安全測試與紅隊演練,
企業可採取資料導向的方法進行模型與安全功能的選擇及配置, 協助其更妥善地保護 AI 工作負載,免受不斷演進的威脅攻擊。
細節探討
- 進階推論與模型最佳化:Red Hat AI Inference 在其分散式推論功能中加入請求優先級排序,
允許互動與背景流量共享同一端點, 同時能在負載下優先處理對延遲敏感的請求。Red Hat AI Inference 亦從 Red Hat OpenShift 延伸至包含 CoreWeave 與 Azure 在內的其他 Kubernetes 服務,為企業提供具備跨環境一致性的推論堆疊。推測解碼(Spe culative decoding)支援已全面推出,該功能可將回應速度提升 2 至 3 倍,並在幾乎不影響品質的狀態下,降低每次互動的成本。 - 受治理的模型即服務(MaaS):該功能使得平台工程師能透過具
備安全增強的 API 端點,並以標準的 OpenAI 相容介面交付精選且經驗證的模型,以便對內部模型與外部 API 進行統一治理,並與基於身分提供者(IDP)的驗證進行整合。 - 整合的提示詞管理:平台提供統一的工具,
將提示詞視為一等資料資產進行建置與管理。 將驅動模型與代理的輸入內容儲存於中央登錄檔中, 為開發人員與管理員提供單一真實來源(single source of truth)。 - 針對模型與代理的自動化評估:Red Hat AI 3.4 導入評估中心,用於評估大型語言模型(LLM)、AI 應用程式與代理、不受特定框架限制的統一 AI 評估控制層。將碎片化的測試方法替換為對品質、
準確性與風險進行基準測試的統一方法。 - 多層次安全:自動化的對抗性掃描(adversarial scanning)現已直接整合至開發生命週期中。Red Hat AI 平台運用 Chatterbox Labs 的技術,使用 Garak 篩選模型與代理系統中的越獄(jailbreaks)、
提示詞注入與偏見等風險,並搭配 NVIDIA NeMo Guardrails 以確保執行期間的安全性。 - 生產就緒的可觀測性:MLflow 的整合提供代理執行的可見度,透過 OpenTelemetry 實現端到端追蹤,包含 LLM 呼叫、推理步驟、工具執行、模型回應與詞元使用情況。
這為涵蓋提示詞、詞嵌入(embeddings)與 RAG 配置的整個生命週期建立透明的稽核軌跡(audit trail),用以支援除錯與稽核。MLFlow 亦為生成式 AI 與預測式 AI 應用情境提供整合式的實驗追蹤與工件管理。 - 基於身分的治理:Red Hat AI 利用加密身分管理(SPIFFE/SPIRE)使企業能以短效期
權杖取代靜態的硬編碼金鑰(hardcoded keys)。該功能支援自主式代理在整個堆疊中的最小權限(le ast-privilege)操作, 並協助確認代理行動與經驗證的身分具關聯性。 - 自動化體驗:AutoRAG 與 AutoML 等工具將複雜的 AI 任務自動化,範圍涵蓋從為特定資料集選擇最有效的檢索策略,
到建置與最佳化傳統的預測模型。 - 硬體靈活性與託管雲:Red Hat AI 3.4 為 NVIDIA Blackwell GPU 與 AMD MI325X 架構提供 Day-0 支援。透過擴展此統一平台架構以原生型態運行於第三方託管雲中(
包含透過 IBM Cloud 上全新的 Red Hat AI Inference),Red Hat 在廣泛的硬體與雲端服務供應商之間提供營運一致性。
夥伴證言
CoreWeave AI 服務產品管理副總裁 Urvashi Chowdhary 表示:「CoreWeave 與 Red Hat 的合作奠基於對開放性的共同承諾,
NVIDIA 企業軟體副總裁 John Fanelli 分享:「為確保大規模的可靠營運,
服務提供狀態
● Red Hat AI 3.4 預計將於本月稍晚正式推出。
額外資源
- 閱讀關於 Red Hat AI 3.4 的部落格文章
Additional Resources
- 閱讀關於 Red Hat AI 3.4 的部落格文章
Connect with Red Hat
- 深入了解 Red Hat
- Red Hat Taiwan 官網
- 加入 Red Hat Taiwan Facebook 專頁
- 關注 Red Hat 新聞
- 閱讀 Red Hat 部落格
- 在 Red Hat Twitter / X 追蹤 Red Hat
- 在 YouTube 觀看 Red Hat 影片
- 在 LinkedIn 追蹤 Red Hat
In short
透過提供統一的硬體底層至智慧代理平台,Red Hat AI 3.4 簡化代理工作流程的開發與部署,
Mentioned in this article
Red Hat AI, Red Hat OpenShift AI
For more information
- 閱讀關於 Red Hat AI 3.4 的部落格文章
- 前瞻性聲明
除此處包含的歷史訊息和討論外,
本新聞稿中包含的陳述可能符合美國 1995 年「私人證券訴訟改革法」所定義之前瞻性陳述。 前瞻性陳述是基於公司現階段對未來業務和財務表現的假設。 這些陳述涉及許多風險、 不確定性和其他可能導致與實際結果出現重大差異的因素。 本新聞稿中的任何前瞻性陳述僅在發布之日起生效。除法律要求外, Red Hat 公司不承擔更新或修訂任何前瞻性陳述的義務。