La logique de Meta, telle que rapportée, est d'optimiser le rapport calcul CPU/GPU au niveau du rack et d'améliorer le rapport coût-efficacité de la bande passante mémoire pour ses charges de travail RecSys, qui effectuent des milliards d'inférences par jour .
Le MI455X standard, qui équipe le système rack Helios d'AMD, est un fleuron de l'ingénierie basé sur l'architecture CDNA 5. Il utilise 8 chiplets de calcul gravés en N2 (2 nm) chez TSMC et 12 piles HBM4 12-Hi pour offrir 432 Go de mémoire . La version de Meta réduit de moitié le nombre de cœurs de calcul (4) et n'utilise que 6 piles HBM4 8-Hi, pour une mémoire totale de seulement 144 Go
. C'est en gros la moitié du silicium de calcul et un tiers de la bande passante mémoire du MI455X complet.
Parce qu'elle utilise moins de chiplets et de piles HBM, la variante de Meta est également physiquement plus petite, consomme moins d'énergie et nécessite un packaging moins complexe, ce qui réduit le coût par accélérateur .
SemiAnalysis a formulé plusieurs critiques acerbes à l'encontre de la décision de Meta :
La critique principale est qu'en réduisant la puce, Meta sacrifie la polyvalence et la pérennité au profit d'une optimisation étroite des coûts à court terme, risquant de s'enfermer dans un matériel moins performant pour les charges de travail d'IA de pointe .
Tous les observateurs ne sont pas de cet avis. Certaines défenses de l'approche notent que les systèmes de recommandation n'ont pas besoin de la capacité des grands modèles de langage (LLM) de pointe. Ce dont ils ont besoin, c'est d'un rapport bande passante par dollar pour une tâche exécutée des milliards de fois par jour, ce qui fait de la puce réduite une spécialisation rationnelle plutôt qu'une erreur .
Le 24 février 2026, Meta et AMD ont annoncé un partenariat stratégique de cinq ans d'une valeur de 60 milliards de dollars pour déployer jusqu'à 6 gigawatts de GPU AMD Instinct pour l'infrastructure IA de Meta . Les termes clés incluent :
Le « Half-MI450 » customisé est la première concrétisation concrète de ce mégacontrat : une puce taillée sur mesure pour les besoins d'inférence des systèmes de recommandation de Meta, conçue pour maximiser le rapport coût-efficacité et la consommation électrique par inférence à une échelle massive, exactement ce que le partenariat de 60 milliards de dollars était structuré pour permettre .