这款定制的MI450加速器并非公开市场产品,而是Meta与AMD联合为其内部工作负载设计的变体。据SemiAnalysis称,该芯片利用了AMD的芯粒(chiplet)架构,创建了一个计算和内存资源大幅缩减的版本,专门针对推荐系统在内存带宽与成本效率上的极致需求进行调优。
据报道,Meta的理由是:为了优化机架级系统的CPU与GPU算力配比,并提升其推荐系统工作负载的内存带宽成本效益——这些系统每天运行数十亿次推理。
| 规格 | 标准AMD Instinct MI455X | Meta定制版本 | 差异 |
|---|---|---|---|
| 计算芯粒 | 8个(基于台积电N2工艺) | 4个 | 减少50% |
| HBM4堆叠与总内存 | 12×36GB(12-Hi)= 432GB | 6×24GB(8-Hi)= 144GB | 减少约67% |
| 总内存带宽 | 约19.6TB/s | 按比例缩减 | 显著降低 |
标准的Instinct MI455X是AMD基于CDNA 5架构的工程旗舰,用于其Helios机架系统。它采用8个台积电N2(2nm)工艺的计算芯粒和12个HBM4 12-Hi堆叠,提供432GB内存。Meta的定制版本将计算芯片减半至4个,并降级为6个HBM4 8-Hi堆叠,仅提供144GB内存。这相当于只有完整版MI455X一半的计算硅面积和三分之一的内存带宽。
由于使用了更少的芯粒和HBM堆叠,Meta的变体物理尺寸更小,功耗和封装复杂度更低,从而降低了每颗加速器的成本。
SemiAnalysis对Meta的决策提出了几项尖锐批评:
核心批评在于:通过削减芯片规格,Meta用通用性和未来可扩展性换取了狭隘的短期成本优化,可能导致自身被锁定在无法支持前沿AI工作负载的硬件上。
不过,并非所有观察者都认同。一些辩护意见指出,推荐系统并不需要前沿大语言模型那样的容量。它们需要的是在每天执行数十亿次的任务上拥有最优的带宽成本比,因此削减芯片规格是一种理性的专业化选择,而非错误。
2026年2月24日,Meta与AMD宣布了一项为期五年、价值600亿美元的战略合作,旨在Meta的AI基础设施中部署高达6吉瓦的AMD Instinct GPU。关键条款包括:
这款定制的“半块MI450”正是该巨额合作的首个具体产物:一款专门针对Meta推荐推理需求、旨在极端机架规模下最大化每次推理的成本与能效的芯片——这正是600亿美元合作所要达成的目标。