每座 Helios 機架嘅關鍵規格 —— 根據 AMD 官方產品頁同說明書 :
| 組件 | 規格 |
|---|---|
| GPU | 72 塊 AMD Instinct MI455X(CDNA 5,TSMC N2) |
| CPU | AMD EPYC「Venice」(Zen 6,第 6 代) |
| 共用記憶體 | 31 TB HBM4 |
| 總記憶體頻寬 | 1.4 PB/s |
| 每 GPU 記憶體 | 432 GB HBM4,頻寬 19.6 TB/s |
| 每 GPU 運算力 | 40 FP4 PFLOPS / 20 FP8 PFLOPS |
| 機架級運算力 | 2.9 FP4 exaFLOPS(推理),1.4 FP8 exaFLOPS(訓練) |
| 網絡 | AMD Pensando「Vulcano」搭配 UALink |
| 外形 | 18 個運算托盤(每個托盤 4 塊 GPU + 1 粒 EPYC Venice),雙闊機架 |
| 預計售價 | 每個機架約 525 萬美元 |
MI455X 嘅 FP4 運算力比上一代 MI350 系列高出大約 2 倍 。Helios 係 AMD 對抗 Nvidia Vera Rubin 平台嘅主力機架級產品,目前已鎖定 Microsoft、Meta、OpenAI、Oracle 同 Anthropic 等客戶 。
呢項合作喺 Advancing AI 2026 大會上(7 月 23 日)公布 。AMD 同 Cerebras 聯手開發一個 分離式推理平台,將 AI 推理分做兩個階段 :
兩個系統透過高速互連技術結合成一個完整嘅分離式解決方案 。
號稱效能: 比傳統架構高達 5 倍 tokens per second per watt(根據 2026 年 7 月用 Kimi 2.6 1T 模型做嘅模擬推算)。
供應時間: 呢個聯合 AI 推理解決方案預計喺 2026 年下半年 透過 雲端服務商 提供 。Cerebras 會喺自己嘅數據中心部署 Helios 系統,解決方案會率先喺 Cerebras Cloud 推出 。
Cerebras 行政總裁 Andrew Feldman 喺會上表示,呢個架構直接針對 Nvidia 嘅 Groq LPU,目標係 代理型 AI(Agentic AI)工作負載,呢類應用對低延遲推理要求極高 。
呢項合作喺 7 月 22 日經 AMD 官方新聞稿公布 :
協議條款:
呢次合作令 Anthropic 加入 AMD 嘅主要 AI 客戶名單,同 OpenAI、Meta、Oracle 同 Microsoft 睇齊 。協議中提到嘅 MI450 系列就係 Helios 機架所用嘅 GPU 世代,其中 MI455X 係首批 Helios 量產型號使用嘅具體 SKU 。
| 產品 / 計劃 | 供應時間 |
|---|---|
| Helios 機架(MI455X + EPYC Venice) | 已量產;2026 年第三季尾 開始出貨 |
| AMD-Cerebras 分離式推理平台 | 2026 年下半年 雲端供應 |
| Anthropic MI450 部署(首 1 吉瓦) | 2027 年上半年 啟動 |
| MI455X 工程樣本 | 2026 年下半年;量產 2027 年第二季 |
所有效能數字均為 AMD 自行公布,未經獨立基準測試驗證 。Helios 約 525 萬美元 / 機架嘅定價,以及 Cerebras 號稱 5 倍 throughput-per-watt 嘅效能,都係基於廠商嘅模擬推算。