微軟之所以決定同時用AMD Helios同Nvidia Vera Rubin,最主要嘅原因係要降低供應鏈風險,避免被單一供應商綁死。呢個做法同微軟喺Azure同Copilot入面「唔綁死單一AI模型」嘅策略係同一道理。行政總裁Satya Nadella親口證實:「我哋會係最早一批雲端服務供應商,同時部署AMD Helios同Nvidia Vera Rubin嘅新一代機架式AI基建。」咁樣做可以令微軟喺談判時有更多牙力,萬一其中一間供應商出現產能不足,都有後備方案。業界普遍將呢個做法形容為「兩邊落注」。
AMD同微軟都冇公開確實嘅定價,不過根據Futurum Group嘅分析,兩個平台嘅機架價格大約係:
換句話講,Helios每個機架貴咗大約40%。呢個溢價主要因為Helios有更大容量嘅HBM4記憶體、開放式架構,同埋AMD自家整合咗CPU、GPU同網絡技術嘅成套方案。
AMD嘅講法係,Helios雖然買機架嘅時候貴啲,但實際用起上嚟嘅效能更加抵。根據AMD自己實驗室嘅數據,Helios做到:
AMD行政總裁Lisa Su喺Advancing AI 2026發布會上話,Helios「比競爭對手喺最大型模型上提供15%或以上嘅表現,多50% HBM容量,而且每美金可以產生多30%嘅token」。
不過,分析師提醒呢啲都只係出貨前嘅估算數字。Futurum Group就話:「AMD話自己效能高15%、每美金多30% token,呢啲都係用供應商自己嘅計算方法同仲未出貨嘅對手比較,係咪真係咁堅,要等兩季之後實際投產先會知道。」
AMD Helios係一個專為AI設計、用液體冷卻嘅機架式系統,係AMD到目前為止最完整嘅AI硬件方案:
| 組件 | 規格 |
|---|---|
| GPU | 72塊 AMD Instinct MI455X |
| GPU架構 | CDNA 5(台積電2nm/3nm晶片混合封裝) |
| 每粒GPU晶體管數量 | 3200億粒 |
| CPU | 18粒第6代AMD EPYC「Venice」(每個運算托盤一粒,最多256核心) |
| 網絡 | AMD Pensando「Vulcano」800 AI網絡卡(800 Gbps以太網,每粒GPU最多2.4 Tbps scale-out頻寬) |
| Scale-up互連 | UALink(Ultra Accelerator Link,通過以太網隧道傳輸) |
| Scale-out互連 | 跟隨Ultra Ethernet Consortium(UEC)標準 |
| 總HBM4記憶體 | 每個機架31 TB |
| 每粒GPU記憶體 | 432 GB(12組HBM4堆棧,每組36 GB) |
| 每粒GPU記憶體頻寬 | 19.6 TB/s |
| 總記憶體頻寬 | 每個機架1.7 PB/s |
| FP4效能 | 每個機架2.9 exaFLOPS |
| FP8效能 | 每個機架1.4 exaFLOPS |
| Scale-up頻寬 | 260 TB/s |
| Scale-out頻寬 | 43 TB/s |
| 外型 | 18個液冷運算托盤(每個4塊GPU)+ 6個交換托盤,符合OCP Open Rack Wide標準 |
| 每粒GPU效能 | 40 PFLOPS FP4,20 PFLOPS FP8 |
每個運算托盤裝咗四塊MI455X GPU、一粒EPYC Venice CPU同Pensando網絡晶片,全部經由UALink協定連接,令到72粒GPU可以當做一個大型運算單位嚟用。
AMD已經確認以下早期Helios客戶:
一個值得注意嘅缺席者:Anthropic喺截至2026年7月嘅主要發布入面,並未被公開列為早期Helios客戶。
微軟決定同時用AMD Helios同Nvidia Vera Rubin,意味住AI硬件市場已經進入咗一個新階段。大型雲端服務商唔再依賴單一供應商,而係投資喺平台多元化上面,確保供應穩定、增加議價能力,同埋獲取唔同嘅效能特點。
AMD Helios憑住31 TB HBM4記憶體同埋開放式以太網互連,特別適合大規模推論工作,因為呢類工作嘅吞吐量同成本直接取決於記憶體容量同頻寬。預計Helios會喺2026年下半年出貨,到時就要睇實際生產嘅基準測試結果,先知AMD呢啲效能宣稱係咪真係兌現到。