這款基於 MI450 的客製加速器並非公開市場上可購買的產品。它是 Meta 與 AMD 共同設計、針對 Meta 內部工作負載量身打造的變體。根據 SemiAnalysis 報導,該晶片利用 AMD 的小晶片架構,創造出一個運算與記憶體資源大幅縮減的版本,專門針對推薦系統所要求的每美元記憶體頻寬比進行最佳化。
據報導,Meta 的考量是在機架層級最佳化 CPU 與 GPU 的運算比例,並改善推薦系統工作負載的記憶體頻寬成本效益;這些推薦系統每天執行數十億次推論。
| 規格 | 標準 AMD Instinct MI455X | Meta 客製版 | 差異 |
|---|---|---|---|
| 運算晶片 | 8 顆(採用台積電 N2 製程) | 4 顆 | 減少 50% |
| HBM4 堆疊及總記憶體 | 12 × 36 GB(12‑Hi)= 432 GB | 6 × 24 GB(8‑Hi)= 144 GB | 記憶體減少約 67% |
| 總記憶體頻寬 | 約 19.6 TB/s | 按比例縮減 | 顯著降低 |
標準 Instinct MI455X 是 AMD 的工程旗艦產品,採用 CDNA 5 架構、8 顆基於台積電 N2(2nm)製程的運算小晶片,以及 12 個 HBM4 12-Hi 堆疊,提供 432 GB 記憶體。Meta 的客製版將運算晶片減半至 4 顆,並降級為 6 個 HBM4 8-Hi 堆疊,僅提供 144 GB 記憶體。這基本上等於全規格 MI455X 的一半運算矽晶片與三分之一記憶體頻寬。
由於使用較少的小晶片和 HBM 堆疊,Meta 的變體晶片體積更小、功耗與封裝複雜度更低,從而降低了每顆加速器的成本。
SemiAnalysis 對 Meta 的決定提出了數項嚴厲批評:
核心批評在於,透過削弱晶片規格,Meta 為了狹隘的近期成本最佳化,犧牲了多功能性與未來擴充性,可能讓自己被排除在邊際 AI 工作負載所需的更強大硬體之外。
然而,並非所有觀察家都同意此觀點。一些辯護意見指出,推薦系統並不需要邊際大型語言模型的運算能力;它們需要的是一個每天執行數十億次任務的每美元頻寬最佳化方案,因此規格縮減的晶片是理性的專業化策略,而非錯誤。
2026 年 2 月 24 日,Meta 與 AMD 宣布了一項為期五年的 600 億美元戰略合作,計劃在 Meta 的 AI 基礎設施中部署高達 6 吉瓦的 AMD Instinct GPU。主要條款包括:
這款客製的「半顆 MI450」正是這筆鉅額交易的第一項具體產品體現:一顆專門為 Meta 推薦推論需求設計、旨在極大機架規模下最大化每次推論成本效益與功耗效率的晶片,完全符合這項 600 億美元合作夥伴關係的結構目標。