AMD 與 Cerebras 宣布將其硬體整合至一套 AI 推理系統中,該系統承諾在延遲與成本上壓制 Nvidia,兩家公司於週四表示。
AMD 與 Cerebras 宣布將其硬體整合至一套 AI 推理系統中,該系統承諾在延遲與成本上壓制 Nvidia,兩家公司於週四表示。

AMD 與 Cerebras 宣布將其硬體整合至一套 AI 推理系統中,該系統承諾在延遲與成本上壓制 Nvidia,兩家公司於週四表示。
「這是業界首次以這種方式拆分推理流程——利用 Cerebras 處理超低延遲的解碼階段,並由 AMD 負責高吞吐量的預填充階段,」Cerebras 執行長 Andrew Feldman 在接受採訪時表示。
此一整合方案將搭配 AMD Helios 機櫃——每台機櫃內含 72 顆 Instinct MI455X GPU 與 18 顆第六代 Epyc「Venice」CPU——以及專為快速生成 token 而優化的 Cerebras 晶圓級引擎。AMD 宣稱,與領先的競爭對手解決方案相比,Helios 每美元可產出最多 30% 更多的推理 token,此處直接指向 Nvidia 現已全面量產並出貨給 OpenAI、CoreWeave 及微軟等客戶的 Vera Rubin NVL72 平台。Feldman 表示,該系統將從第四季起,自 Cerebras 擁有的資料中心出貨。
此合作為 AMD 在 AI 基礎設施中成長最迅速的環節——推理領域——提供了一項差異化產品;在推理市場中,Nvidia 的主導地位不如其在訓練領域那般穩固。AMD 預期,隨著工作負載從模型訓練轉向即時推理與自主式 AI,AI 加速器的整體潛在市場將在 2030 年前超過一兆美元。
架構如何運作
該系統將推理分為兩個階段。AMD Helios 負責預填充階段——將用戶查詢與模型背景進行比對處理——而 Cerebras 晶圓級引擎則以毫秒級速度生成 token。此方案瞄準那些需要即時回應的應用場景,例如對話式代理、程式碼助手及即時詐欺偵測。Nvidia 近期收購專注於低延遲推理晶片的初創公司 Groq,也正在組建類似的技術能力。
合作夥伴已開始排隊
OpenAI 高層 Sachin Katti 在 AMD 的 Advancing AI 活動上表示,OpenAI 預計將於 2026 年第四季開始啟用 Helios,並在 2027 年加速部署。Anthropic 已獲得 AMD 於週三承諾最高達 50 億美元的資金支持,計劃部署 2 吉瓦的 MI450 系列 GPU 於 Helios 機櫃中,用以運行其 Claude 模型,首批 1 吉瓦將於 2027 年上半年出貨。Meta 也正在驗證 Helios 機櫃,以進行吉瓦級別的部署。
投資人影響
AMD 股價在發表會期間下跌約 4%,儘管該股今年以來已翻了一倍以上,顯示市場已將諸多雄心勃勃的產品發表定價在股價中。Nvidia 的 Vera Rubin 平台已開始貢獻營收,而 AMD 的 Helios 才剛進入量產階段。與 Cerebras 的合作為 AMD 在低延遲推理領域帶來時間上的領先優勢,但營收貢獻將取決於客戶採用此種拆分式架構的速度。AMD 目前的本益比約為 22 倍,低於 Nvidia 的 35 倍,反映出兩者在執行可信度上的差距——而 AMD 正試圖透過此類合作來縮小這一差距。
本文僅供資訊參考,不構成投資建議。