Spécifications clés (par rack Helios) — d'après la fiche produit officielle d'AMD :
| Composant | Spécification |
|---|---|
| GPU | 72x AMD Instinct MI455X (CDNA 5, TSMC N2) |
| CPU | AMD EPYC « Venice » (Zen 6, 6e génération) |
| Mémoire poolée | 31 To HBM4 |
| Bande passante mémoire agrégée | 1,4 Po/s |
| Mémoire par GPU | 432 Go HBM4, 19,6 To/s de bande passante |
| Calcul par GPU | 40 PFLOPS FP4 / 20 PFLOPS FP8 |
| Calcul au niveau rack | 2,9 exaFLOPS FP4 (inférence), 1,4 exaFLOPS FP8 (entraînement) |
| Réseau | AMD Pensando « Vulcano » avec UALink |
| Format | 18 plateaux de calcul (4 GPU + 1 EPYC Venice par plateau), rack double largeur |
| Prix estimé | ~5,25 millions de dollars par rack |
Le MI455X offre environ 2 fois le calcul FP4 de la précédente série MI350 . Le système Helios est le principal concurrent d'AMD face à la plateforme Vera Rubin de Nvidia et compte déjà des clients comme Microsoft, Meta, OpenAI, Oracle et Anthropic .
Annoncé sur scène lors de l'Advancing AI 2026 le 23 juillet, AMD et Cerebras construisent une plateforme d'inférence dissociée qui sépare l'inférence IA en deux phases :
Les deux systèmes fonctionnent comme une seule solution dissociée via une interconnexion haut débit .
Performance annoncée : Jusqu'à 5 fois plus de tokens par seconde par watt par rapport aux architectures conventionnelles (sur la base d'une modélisation de juillet 2026 utilisant le modèle Kimi 2.6 1T) .
Disponibilité : La solution d'inférence conjointe AMD-Cerebras devrait être disponible via des fournisseurs cloud au second semestre 2026 . Cerebras déploiera des systèmes Helios dans ses propres centres de données, la solution étant d'abord disponible via Cerebras Cloud .
Le PDG de Cerebras, Andrew Feldman, a déclaré lors de l'événement que l'architecture ciblait directement les LPU Groq de Nvidia et était positionnée pour les charges de travail d'IA agentique où l'inférence à faible latence est cruciale .
Annoncé le 22 juillet 2026 via un communiqué de presse officiel d'AMD :
Termes de l'accord :
Cet accord ajoute Anthropic à la liste croissante des grands clients IA d'AMD, aux côtés d'OpenAI, Meta, Oracle et Microsoft . La série MI450 mentionnée dans cet accord est la génération de GPU qui alimente les racks Helios — le MI455X est le SKU spécifique utilisé dans les premières unités de production Helios .
| Produit / Programme | Disponibilité |
|---|---|
| Rack Helios (MI455X + EPYC Venice) | En production maintenant ; expéditions fin T3 2026 |
| Inférence dissociée AMD-Cerebras | Disponibilité dans le cloud S2 2026 |
| Déploiement MI450 chez Anthropic (1er GW) | Début S1 2027 |
| Échantillons techniques MI455X | S2 2026 ; production de masse T2 2027 |
Toutes les performances sont celles communiquées par AMD et n'ont pas encore été évaluées de manière indépendante . Le prix du Helios d'environ 5,25 millions de dollars par rack et l'affirmation de Cerebras d'un débit multiplié par 5 par watt sont basés sur des modélisations des fournisseurs.