L'acceleratore custom basato su MI450 non è un prodotto disponibile sul mercato libero. È una variante co-ingegnerizzata appositamente per i carichi di lavoro interni di Meta. Secondo SemiAnalysis, il chip sfrutta l'architettura chiplet di AMD per creare una versione con risorse di calcolo e memoria significativamente ridotte, ottimizzata specificamente per il rapporto costo-efficienza per la larghezza di banda della memoria che i sistemi di raccomandazione richiedono .
La logica di Meta, come riportato, è quella di ottimizzare il rapporto di calcolo CPU-GPU a livello di rack e migliorare l'efficienza in termini di costo della larghezza di banda della memoria per i suoi carichi di lavoro RecSys (sistemi di raccomandazione), che eseguono miliardi di inferenze al giorno .
| Specifica | AMD Instinct MI455X Standard | Variante Custom Meta | Differenza |
|---|---|---|---|
| Chiplet di calcolo | 8 (su TSMC N2) | 4 | 50% in meno |
| Stack HBM4 e memoria totale | 12 × 36 GB (12‑Hi) = 432 GB | 6 × 24 GB (8‑Hi) = 144 GB | ~67% di memoria in meno |
| Larghezza di banda totale | ~19.6 TB/s | Ridotta proporzionalmente | Significativamente inferiore |
L'Instinct MI455X standard, che alimenta il sistema rack-scale Helios di AMD, è un fiore all'occhiello dell'ingegneria basato sull'architettura CDNA 5. Utilizza 8 chiplet di calcolo sul processo N2 (2nm) di TSMC e 12 stack HBM4 12-Hi per fornire 432 GB di memoria . La versione custom di Meta dimezza i die di calcolo (scendendo a 4) e passa a 6 stack HBM4 8-Hi, offrendo solo 144 GB di memoria . Si tratta, in sostanza, della metà del silicio di calcolo e di un terzo della larghezza di banda della memoria del MI455X completo.
Poiché il chip utilizza meno chiplet e stack HBM, la variante di Meta è anche fisicamente più piccola, consuma meno energia e ha una minore complessità di packaging, riducendo il costo per acceleratore .
SemiAnalysis ha mosso diverse critiche feroci alla decisione di Meta:
Il nocciolo della critica è che, riducendo le specifiche del chip, Meta sacrifica la versatilità e la capacità di adattamento futuro per un'ottimizzazione dei costi a breve termine, rischiando potenzialmente di precludersi l'accesso all'hardware più potente necessario per i carichi di lavoro di IA più avanzati .
Non tutti gli osservatori sono d'accordo. Alcune difese dell'approccio notano che i sistemi di raccomandazione non necessitano della capacità dei modelli linguistici di frontiera (LLM). Ciò di cui hanno bisogno è la larghezza di banda per dollaro su un'attività eseguita miliardi di volte al giorno, rendendo il chip ridotto una specializzazione razionale piuttosto che un errore .
Il 24 febbraio 2026, Meta e AMD hanno annunciato una partnership strategica quinquennale da 60 miliardi di dollari per implementare fino a 6 gigawatt di GPU AMD Instinct per l'infrastruttura IA di Meta . I termini chiave includono:
La 'Half-MI450' custom è la prima manifestazione concreta di questo mega-accordo: un chip su misura per le esigenze di inferenza dei sistemi di raccomandazione di Meta, progettato per massimizzare l'efficienza in termini di costo e consumo energetico per inferenza su scala massiccia a livello di rack, esattamente ciò che la partnership da 60 miliardi di dollari è stata strutturata per abilitare .