El acelerador personalizado basado en el MI450 no es un producto que se pueda comprar en el mercado abierto. Es una variante co-diseñada específicamente para las cargas de trabajo internas de Meta. Según SemiAnalysis, el chip utiliza la arquitectura de chiplets de AMD para crear una versión con recursos de cómputo y memoria significativamente reducidos, ajustada para la relación ancho de banda por dólar que exigen los sistemas de recomendación .
El razonamiento de Meta, según lo informado, es optimizar la proporción de cómputo entre CPU y GPU a nivel de rack y mejorar la eficiencia en costes del ancho de banda de memoria para sus cargas de trabajo RecSys (sistemas de recomendación), que ejecutan miles de millones de inferencias al día .
| Especificación | AMD Instinct MI455X Estándar | Variante Personalizada de Meta | Diferencia |
|---|---|---|---|
| Chiplets de cómputo | 8 (en TSMC N2) | 4 | 50% menos |
| Pilas HBM4 y memoria total | 12 × 36 GB (12‑Hi) = 432 GB | 6 × 24 GB (8‑Hi) = 144 GB | ~67% menos memoria |
| Ancho de banda de memoria total | ~19,6 TB/s | Reducido proporcionalmente | Significativamente menor |
El MI455X estándar, que impulsa el sistema rack-scale Helios de AMD, es un buque insignia de ingeniería construido sobre la arquitectura CDNA 5. Utiliza 8 chiplets de cómputo en el proceso N2 (2nm) de TSMC y 12 pilas HBM4 12-Hi para ofrecer 432 GB de memoria . La versión personalizada de Meta reduce los chips de cómputo a la mitad—solo 4—y baja a 6 pilas HBM4 8-Hi, lo que da como resultado solo 144 GB de memoria . Esto equivale, en esencia, a la mitad del silicio de cómputo y un tercio del ancho de banda de memoria del MI455X completo.
Dado que el chip utiliza menos chiplets y pilas HBM, la variante de Meta es también físicamente más pequeña y consume menos energía y complejidad de empaquetado, lo que reduce el coste por acelerador .
SemiAnalysis lanzó varias críticas contundentes contra la decisión de Meta:
La queja principal es que, al recortar el chip, Meta sacrifica la versatilidad y la preparación para el futuro en favor de una optimización de costes a corto plazo, lo que podría bloquearle el acceso al hardware más potente necesario para las cargas de trabajo de IA de frontera .
No todos los observadores están de acuerdo. Algunos defensores del enfoque señalan que los sistemas de recomendación no necesitan la capacidad de los modelos de lenguaje masivos (LLMs) de frontera. Lo que necesitan es ancho de banda por dólar en una tarea que se ejecuta miles de millones de veces al día, lo que convierte al chip recortado en una especialización racional, no en un error .
El 24 de febrero de 2026, Meta y AMD anunciaron una alianza estratégica quinquenal por valor de 60 000 millones de dólares para desplegar hasta 6 gigavatios de GPUs AMD Instinct para la infraestructura de IA de Meta . Los términos clave incluyen:
El "Half-MI450" personalizado es la primera manifestación concreta de este megacuerdo: un chip diseñado específicamente para las necesidades de inferencia de los sistemas de recomendación de Meta, diseñado para maximizar la eficiencia de costes y energía por inferencia a una escala masiva de rack, exactamente para lo que se estructuró la asociación de 60 000 millones de dólares .