Specifiche principali (per singolo rack Helios) — dalla scheda ufficiale e dal brochure AMD :
| Componente | Specifica |
|---|---|
| GPU | 72x AMD Instinct MI455X (CDNA 5, TSMC N2) |
| CPU | AMD EPYC "Venice" (Zen 6, 6a gen.) |
| Memoria aggregata | 31 TB HBM4 |
| Banda passante memoria aggregata | 1,4 PB/s |
| Memoria per GPU | 432 GB HBM4, 19,6 TB/s di banda |
| Calcolo per GPU | 40 FP4 PFLOPS / 20 FP8 PFLOPS |
| Calcolo a livello rack | 2,9 FP4 exaFLOPS (inferenza), 1,4 FP8 exaFLOPS (training) |
| Rete | AMD Pensando "Vulcano" con UALink |
| Fattore di forma | 18 vassoi di calcolo (4 GPU + 1 EPYC Venice per vassoio), rack a doppia larghezza |
| Prezzo stimato | Circa 5,25 milioni di $ per rack |
L'MI455X offre circa il doppio del calcolo FP4 rispetto alla precedente serie MI350 . Il sistema Helios è il principale concorrente di AMD nel segmento rack-scale rispetto alla piattaforma Vera Rubin di Nvidia e ha già raccolto clienti tra cui Microsoft, Meta, OpenAI, Oracle e Anthropic .
Annunciata sul palco del Advancing AI 2026 (23 luglio), AMD e Cerebras stanno costruendo una piattaforma di inferenza disaggregata che divide l'inferenza AI in due fasi :
I due sistemi operano come un'unica soluzione disaggregata tramite interconnessione ad alta velocità .
Prestazioni dichiarate: Fino a 5x più token al secondo per watt rispetto alle architetture convenzionali (basato su modelli di luglio 2026 con il modello Kimi 2.6 1T) .
Disponibilità: La soluzione congiunta AMD-Cerebras per l'inferenza AI sarà disponibile tramite fornitori cloud nella seconda metà del 2026 . Cerebras implementerà i sistemi Helios nei propri data center, e la soluzione sarà disponibile prima su Cerebras Cloud .
L'amministratore delegato di Cerebras, Andrew Feldman, ha dichiarato all'evento che l'architettura si rivolge direttamente ai Groq LPU di Nvidia ed è posizionata per carichi di lavoro di IA agentica, dove l'inferenza a bassa latenza è fondamentale .
Annunciata il 22 luglio 2026, tramite comunicato stampa ufficiale AMD :
Termini dell'accordo:
Questo aggiunge Anthropic al crescente elenco di grandi clienti AI di AMD, insieme a OpenAI, Meta, Oracle e Microsoft . La serie MI450 menzionata in questo accordo è la generazione di GPU che alimenta i rack Helios: l'MI455X è lo SKU specifico utilizzato nelle prime unità di produzione Helios .
| Prodotto / Programma | Disponibilità |
|---|---|
| Rack Helios (MI455X + EPYC Venice) | In piena produzione ora; spedizioni entro fine Q3 2026 |
| Inferenza disaggregata AMD-Cerebras | Disponibilità cloud H2 2026 |
| Implementazione MI450 Anthropic (1° GW) | Inizia H1 2027 |
| Campioni ingegneristici MI455X | H2 2026; produzione di massa Q2 2027 |
Tutti i dati sulle prestazioni sono forniti da AMD e non sono ancora stati sottoposti a benchmark indipendenti . Il prezzo di Helios di circa 5,25 milioni di $/rack e l'affermazione di Cerebras di un throughput 5x per watt si basano su modelli del fornitore.