呢粒訂製嘅 MI450 加速器唔係市面有得賣嘅產品。佢係同 AMD 共同設計嘅變種版,專為 Meta 內部工作負載而設。SemiAnalysis 話,呢粒晶片用咗 AMD 嘅晶片架構(chiplet architecture)嚟整一個計算同記憶體資源都大縮水嘅版本,專門針對推薦系統最需要嘅每美元記憶體頻寬(memory-bandwidth-per-dollar)比例嚟校到最靚。
根據報導,Meta 嘅理由係要優化機架系統入面 CPU 同 GPU 嘅計算比例,以及改善佢哋推薦系統(RecSys)工作負載嘅記憶體頻寬成本效益,呢啲系統每日要執行幾十億次推論。
| 規格 | 標準 AMD Instinct MI455X | Meta 自訂版 | 差別 |
|---|---|---|---|
| 計算晶片(Compute chiplets) | 8 組(用台積電 N2 製程) | 4 組 | 少一半 |
| HBM4 堆疊同總記憶體 | 12 × 36 GB (12‑Hi) = 432 GB | 6 × 24 GB (8‑Hi) = 144 GB | 記憶體少大約三分二 |
| 總記憶體頻寬 | 大約 19.6 TB/s | 按比例減少 | 明顯低好多 |
標準版嘅 Instinct MI455X,用嚟驅動 AMD 嘅 Helios 機架系統,係一個建基於 CDNA 5 架構嘅工程旗艦。佢用 8 組喺台積電 N2(2nm)製程上嘅計算晶片,同 12 個 HBM4 12-Hi 堆疊,提供 432 GB 記憶體。Meta 訂製版將計算晶片斬半——得返 4 組——同埋降格到 6 個 HBM4 8-Hi 堆疊,得返 144 GB 記憶體。呢個基本上係得返標準版 MI455X 一半嘅計算晶片面積同三分一嘅記憶體頻寬。
因為用少咗晶片同 HBM 堆疊,Meta 呢粒晶片嘅體積都細啲,用電同封裝複雜度都低啲,每粒加速器嘅成本自然減少。
SemiAnalysis 對 Meta 嘅決定提出咗幾點嚴厲批評:
核心投訴係:Meta 為咗短視嘅成本優化,犧牲咗晶片嘅通用性同將來嘅升級能力,變相令自己用唔到更強勁嘅硬件嚟做前沿 AI 嘅工作負載。
不過,唔係個個都咁睇。都有啲人撐呢個做法,話推薦系統根本唔需要用到前沿大型語言模型嘅容量。佢哋需要嘅係喺每日執行幾十億次嘅任務上,每蚊買到嘅頻寬有幾多,所以呢個縮水版晶片係理性嘅專門化,唔係犯錯。
2026 年 2 月 24 日,Meta 同 AMD 宣布咗一個 五年、600 億美元嘅策略合作關係,用嚟部署 最多 6 吉瓦 嘅 AMD Instinct GPU 喺 Meta 嘅 AI 基建度。主要條款包括:
呢粒訂製嘅「Half-MI450」係呢個大型合作協議嘅第一個實際產品:一粒專為 Meta 推薦系統推論需求而設嘅晶片,用嚟喺大規模機架層級上,最大化每次推論嘅成本同電力效益,正正就係呢個 600 億美元合作協議想做到嘅嘢。