O acelerador customizado baseado no MI450 não é um produto disponível no mercado aberto. É uma variante coengenharia construída especificamente para as cargas de trabalho internas da Meta. De acordo com a SemiAnalysis, o chip usa a arquitetura de chiplets da AMD para criar uma versão com recursos de computação e memória significativamente reduzidos, sintonizados para a relação largura-de-banda-por-dólar que sistemas de recomendação exigem .
A justificativa da Meta, conforme relatado, é otimizar as proporções de computação CPU-para-GPU no nível do rack e melhorar a eficiência de custo da largura de banda de memória para suas cargas de trabalho RecSys, que executam bilhões de inferências por dia .
| Especificação | AMD Instinct MI455X Padrão | Variante Customizada Meta | Diferença |
|---|---|---|---|
| Chiplets de computação | 8 (em TSMC N2) | 4 | 50% a menos |
| Pilhas HBM4 e memória total | 12 × 36 GB (12‑Hi) = 432 GB | 6 × 24 GB (8‑Hi) = 144 GB | ~67% menos memória |
| Largura de banda total de memória | ~19,6 TB/s | Reduzida proporcionalmente | Significativamente menor |
O Instinct MI455X padrão, que alimenta o sistema rack-scale Helios da AMD, é um carro-chefe de engenharia construído na arquitetura CDNA 5. Ele usa 8 chiplets de computação no processo N2 (2nm) da TSMC e 12 pilhas HBM4 12-Hi para fornecer 432 GB de memória . A versão customizada da Meta corta os dies de computação pela metade — para 4 — e reduz para 6 pilhas HBM4 8-Hi, gerando apenas 144 GB de memória . Isso é efetivamente metade do silício de computação e um terço da largura de banda de memória do MI455X completo.
Como o chip usa menos chiplets e pilhas HBM, a variante da Meta também é fisicamente menor e consome menos energia e complexidade de empacotamento, reduzindo o custo por acelerador .
A SemiAnalysis fez várias críticas contundentes à decisão da Meta:
A queixa central é que, ao reduzir o chip, a Meta sacrifica versatilidade e preparação para o futuro em prol de uma otimização de custos de curto prazo, potencialmente se trancando em hardware menos capaz necessário para cargas de trabalho de IA de fronteira .
Nem todos os observadores concordam. Alguns defensores da abordagem observam que sistemas de recomendação não precisam da capacidade de LLMs de fronteira. O que eles precisam é de largura de banda por dólar em uma tarefa executada bilhões de vezes ao dia, tornando o chip reduzido uma especialização racional, e não um erro .
Em 24 de fevereiro de 2026, Meta e AMD anunciaram uma parceria estratégica de cinco anos e US$ 60 bilhões para implantar até 6 gigawatts de GPUs AMD Instinct na infraestrutura de IA da Meta . Os principais termos incluem:
O customizado "Half-MI450" é a primeira manifestação concreta deste megacon trato: um chip adaptado especificamente às necessidades de inferência de recomendação da Meta, projetado para maximizar a eficiência de custo e energia por inferência em escala massiva de rack, exatamente o que a parceria de US$ 60 bilhões foi estruturada para permitir .