單一 Helios 機架關鍵規格(資料來源:AMD 官方產品頁面與說明手冊 ):
| 組件 | 規格 |
|---|---|
| GPU | 72 顆 AMD Instinct MI455X(CDNA 5 架構,台積電 N2 製程) |
| CPU | AMD EPYC「Venice」(Zen 6 架構,第六代) |
| 匯集記憶體 | 31 TB HBM4 |
| 總記憶體頻寬 | 1.4 PB/s |
| 每顆 GPU 記憶體 | 432 GB HBM4,頻寬 19.6 TB/s |
| 每顆 GPU 算力 | 40 FP4 PFLOPS / 20 FP8 PFLOPS |
| 機架級算力 | 2.9 FP4 exaFLOPS(推論),1.4 FP8 exaFLOPS(訓練) |
| 網路 | AMD Pensando「Vulcano」搭配 UALink |
| 外型規格 | 18 個運算托盤(每個托盤含 4 顆 GPU 與 1 顆 EPYC Venice CPU),雙倍寬機架 |
| 預估價格 | 約 525 萬美元 |
MI455X 的 FP4 算力約為前一代 MI350 系列的兩倍 。Helios 系統是 AMD 對抗 Nvidia Vera Rubin 平台的主力機架級產品,目前已確認的客戶包括 Microsoft、Meta、OpenAI、Oracle 和 Anthropic 。
蘇姿丰在 Advancing AI 2026 的主題演講中(7 月 23 日)宣布了此合作案 。AMD 與 Cerebras 將共同打造一個 分離式推論平台(disaggregated inference platform),將 AI 推論過程拆分為兩個階段 :
兩個系統透過高速互連技術,結合成單一分離式解決方案 。
宣稱效能: 相較傳統架構,每瓦每秒 token 數(tokens per second per watt) 最高提升 5 倍(該數據基於 2026 年 7 月使用 Kimi 2.6 1T 模型的模擬)。
供應時程: AMD 與 Cerebras 的聯合 AI 推論解決方案預計於 2026 年下半年 透過 雲端服務商 提供 。Cerebras 將在其資料中心部署 Helios 系統,該解決方案將首先透過 Cerebras Cloud 提供 。
Cerebras 執行長 Andrew Feldman 在會上表示,此架構直接針對 Nvidia 的 Groq LPU 而來,並鎖定 代理型 AI(agentic AI) 工作負載,因為這類應用對低延遲推論至關重要 。
此消息於 2026 年 7 月 22 日透過 AMD 官方新聞稿發布 :
協議內容:
此協議使 Anthropic 加入 AMD 日漸壯大的重要 AI 客戶行列,其他客戶還包括 OpenAI、Meta、Oracle 與 Microsoft 。協議中提到的 MI450 系列 GPU,正是驅動 Helios 機架的那一代產品——MI455X 即為首批 Helios 量產單元所使用的具體型號 。
| 產品 / 計畫 | 供應時程 |
|---|---|
| Helios 機架(MI455X + EPYC Venice) | 已全面量產,預計 2026 年第三季末 開始出貨 |
| AMD-Cerebras 分離式推論 | 預計 2026 年下半年 於雲端提供 |
| Anthropic MI450 部署(首批 1 GW) | 2027 年上半年 開始 |
| MI455X 工程樣品 | 2026 年下半年;量產為 2027 年第二季 |
以上所有效能數據均為 AMD 官方提供,尚未經獨立第三方基準測試驗證 。Helios 約 525 萬美元/機架的定價,以及 Cerebras 5 倍每瓦吞吐量的宣稱,皆基於廠商自身的模擬數據。