Die technischen Daten (pro Helios-Rack) – basierend auf AMDs offiziellen Produktseiten :
| Komponente | Wert |
|---|---|
| GPUs | 72x AMD Instinct MI455X (CDNA 5, TSMC N2) |
| CPUs | AMD EPYC „Venice" (Zen 6, 6. Generation) |
| Arbeitsspeicher (gepoolt) | 31 TB HBM4 |
| Aggregierte Speicherbandbreite | 1,4 PB/s |
| Speicher pro GPU | 432 GB HBM4, 19,6 TB/s Bandbreite |
| Rechenleistung pro GPU | 40 FP4 PFLOPS / 20 FP8 PFLOPS |
| Rechenleistung pro Rack | 2,9 FP4 ExaFLOPS (Inferenz), 1,4 FP8 ExaFLOPS (Training) |
| Netzwerk | AMD Pensando „Vulcano" mit UALink |
| Bauform | 18 Compute-Trays (4 GPUs + 1 EPYC Venice pro Tray), Doppelbreit-Rack |
| Geschätzter Preis | ca. 5,25 Mio. US-Dollar pro Rack |
Der MI455X liefert etwa die doppelte FP4-Rechenleistung der vorherigen MI350-Serie . Helios ist AMDs direkter Konkurrent zu Nvidias Vera-Rubin-Plattform und hat bereits Kunden wie Microsoft, Meta, OpenAI, Oracle und Anthropic gewonnen .
Ebenfalls auf der Bühne der Advancing AI 2026 (23. Juli) gaben AMD und Cerebras den Bau einer disaggregierten Inferenz-Plattform bekannt. Das System teilt die KI-Inferenz in zwei Phasen auf :
Beide Systeme arbeiten per Highspeed-Interconnect als eine einzige Lösung zusammen .
Versprochene Leistung: Bis zu fünfmal höhere Tokens pro Sekunde pro Watt im Vergleich zu herkömmlichen Architekturen (basierend auf Modellierungen vom Juli 2026 mit dem Kimi 2.6 1T Modell) .
Verfügbarkeit: Die gemeinsame AMD-Cerebras-Lösung soll in der zweiten Jahreshälfte 2026 über Cloud-Anbieter verfügbar sein . Cerebras wird Helios-Systeme in seinen eigenen Rechenzentren einsetzen, die Lösung ist zunächst über die Cerebras Cloud erhältlich .
Cerebras-CEO Andrew Feldman sagte auf der Veranstaltung, die Architektur ziele direkt auf Nvidias Groq-LPUs ab und sei für agentische KI-Workloads optimiert, bei denen niedrigste Latenz entscheidend ist .
Bereits am 22. Juli 2026 gab AMD per Pressemitteilung das Abkommen bekannt :
Die Vertragsbedingungen:
Damit reiht sich Anthropic in die wachsende Liste großer AMD-Kunden ein – neben OpenAI, Meta, Oracle und Microsoft . Die genannte MI450-Serie ist die GPU-Generation, die auch in den Helios-Racks zum Einsatz kommt: Der MI455X ist die spezifische SKU der ersten Produktionseinheiten .
| Produkt / Programm | Verfügbarkeit |
|---|---|
| Helios-Rack (MI455X + EPYC Venice) | Serienproduktion läuft; Auslieferung ab Ende Q3 2026 |
| AMD-Cerebras-Inferenz (Cloud) | Verfügbar ab H2 2026 |
| Anthropic MI450-Einsatz (1. GW) | Beginn H1 2027 |
| MI455X-Engineering Samples | H2 2026; Massenproduktion Q2 2027 |
Alle Leistungsangaben stammen von AMD und wurden noch nicht unabhängig getestet . Der Preis von ca. 5,25 Mio. Dollar pro Helios-Rack und die 5x-Durchsatz-angabe von Cerebras basieren auf Modellierungen der Anbieter.