Especificaciones clave (por rack Helios) — según la ficha técnica oficial de AMD :
| Componente | Especificación |
|---|---|
| GPU | 72 AMD Instinct MI455X (CDNA 5, TSMC N2) |
| CPU | AMD EPYC "Venice" (Zen 6, 6.ª gen.) |
| Memoria total | 31 TB HBM4 |
| Ancho de banda agregado | 1.4 PB/s |
| Memoria por GPU | 432 GB HBM4, 19.6 TB/s de ancho de banda |
| Cómputo por GPU | 40 FP4 PFLOPS / 20 FP8 PFLOPS |
| Cómputo total del rack | 2.9 FP4 exaFLOPS (inferencia), 1.4 FP8 exaFLOPS (entrenamiento) |
| Red | AMD Pensando "Vulcano" con UALink |
| Factor de forma | 18 bandejas de cómputo (4 GPU + 1 EPYC Venice por bandeja), rack de ancho doble |
| Precio estimado | ~$5.25 millones por rack |
La MI455X ofrece aproximadamente el doble de cómputo FP4 que la serie MI350 anterior . Helios compite directamente con la plataforma Vera Rubin de Nvidia y ya tiene clientes confirmados como Microsoft, Meta, OpenAI, Oracle y Anthropic .
Anunciada en el evento Advancing AI 2026 (23 de julio), AMD y Cerebras están desarrollando una plataforma de inferencia desagregada que divide el proceso en dos fases :
Ambos sistemas operan como una única solución desagregada mediante interconexión de alta velocidad .
Rendimiento declarado: hasta 5x más tokens por segundo por vatio en comparación con arquitecturas convencionales, según modelado de julio de 2026 usando el modelo Kimi 2.6 1T .
Disponibilidad: la solución conjunta AMD-Cerebras estará disponible a través de proveedores cloud en el segundo semestre de 2026 . Cerebras instalará racks Helios en sus propios centros de datos, y la solución estará disponible primero a través de Cerebras Cloud .
Andrew Feldman, CEO de Cerebras, señaló que la arquitectura apunta directamente a las Groq LPUs de Nvidia y está pensada para cargas de trabajo de IA agente, donde la latencia ultrabaja es crítica .
Anunciada el 22 de julio de 2026 mediante comunicado oficial de AMD :
Términos del acuerdo:
Este acuerdo añade a Anthropic a la creciente cartera de grandes clientes de IA de AMD, que ya incluye a OpenAI, Meta, Oracle y Microsoft . La serie MI450 mencionada es la generación de GPU que impulsa los racks Helios: la MI455X es la SKU concreta de las primeras unidades de producción .
| Producto / Programa | Disponibilidad |
|---|---|
| Rack Helios (MI455X + EPYC Venice) | En producción total; envíos a finales del tercer trimestre de 2026 |
| Inferencia desagregada AMD-Cerebras | Disponibilidad en la nube en el segundo semestre de 2026 |
| Despliegue MI450 de Anthropic (1.er GW) | Comienza en el primer semestre de 2027 |
| Muestras de ingeniería MI455X | Segundo semestre de 2026; producción en masa en el segundo trimestre de 2027 |
Todas las cifras de rendimiento son declaradas por AMD y aún no han sido verificadas de forma independiente . El precio de Helios (~$5.25M/rack) y la afirmación de 5x de rendimiento por vatio de Cerebras se basan en modelado de los proveedores.