Helios is geen losse grafische kaart, maar een zogenoemd rack-scale AI-systeem: een volledige serverkast waarin rekenkracht, processors, geheugen en netwerkverbindingen als één platform samenwerken.
Elke rack bevat volgens AMD:
De MI455X vormt het belangrijkste rekenonderdeel van Helios en is AMD's meest geavanceerde AI-accelerator tot nu toe . Lisa Su noemde het systeem “simply the best AI rack in the world” en claimde dat het de krachtigste rack in de sector is voor het trainen en uitvoeren van zogenoemde frontiermodellen op grote schaal .
AMD zegt dat Helios al in volledige productie is en in dezelfde aanschafperiode wordt geleverd als Nvidia's Vera Rubin NVL72 . De aangekondigde prijs bedraagt 5 tot 5,5 miljoen dollar per rack, oftewel ongeveer 5,25 miljoen dollar bij het midden van die bandbreedte .
De zesde generatie EPYC Venice is gebaseerd op AMD's Zen 6-architectuur. Volgens AMD is het de eerste x86-serverprocessor die op het 2nm-proces van TSMC is gebouwd .
De processor werd tijdens het evenement commercieel gelanceerd en fungeert als cpu-basis in de computetrays van Helios. Venice kan worden uitgerust met maximaal 256 Zen 6-cores .
AMD positioneert Helios vooral op geheugen en bandbreedte. Elke MI455X-gpu beschikt volgens de aangehaalde informatie over 288 GB HBM3E-geheugen. Met 72 gpu's ontstaat een grote gezamenlijke geheugenpool, belangrijk voor AI-modellen die tijdens inferentie — het genereren van antwoorden — zoveel mogelijk in het geheugen moeten blijven .
AMD claimt tegenover Nvidia's Vera Rubin NVL72:
Die cijfers zijn AMD's eigen claims en vormen geen onafhankelijke benchmark. Analisten wijzen erop dat Nvidia nog altijd sterker staat bij het trainen van AI-modellen en beschikt over een volwassener software-ecosysteem rond CUDA . AMD zet daar het open-source ROCm-platform tegenover, dat nog volop in ontwikkeling is .
Tijdens de keynote werden verschillende grote klanten en samenwerkingspartners genoemd :
| Klant of partner | Aangekondigde inzet |
|---|---|
| Microsoft Azure | Strategische klant voor Helios; leveringen starten in de tweede helft van 2026 |
| OpenAI | Tot 6 gigawatt aan AMD-infrastructuur; Helios-racks zijn al in gebruik |
| Meta | Samen met OpenAI goed voor 12 gigawatt aan AMD-acceleratorcapaciteit |
| Oracle | Genoemd als vroege Helios-klant |
| Anthropic | Tot 2 gigawatt aan Helios-infrastructuur |
| AT&T | AMD-platforms worden ingezet of getest |
| Cisco | AMD-platforms worden ingezet of getest |
In het officiële persbericht van AMD werd ook Cerebras als samenwerkingspartner vermeld .
De grootste financiële aankondiging kwam op 22 juli, de eerste dag van het evenement. AMD beloofde een strategische aandeleninvestering van maximaal 5 miljard dollar in Anthropic, het AI-bedrijf achter Claude .
In ruil daarvoor zal Anthropic tot 2 gigawatt aan AMD Instinct MI450-serie-gpu's inzetten via Helios-racks . De eerste gigawatt moet in de eerste helft van 2027 worden uitgerold .
Anthropic-medeoprichter Tom Brown wees op de integratie en prestaties als redenen voor de samenwerking. Beide bedrijven willen daarnaast samenwerken aan AI-veiligheid en beveiliging . De deal is daarmee meer dan alleen een hardwarebestelling: AMD probeert tegelijk zijn positie in de AI-softwareketen en bij grote modelbouwers te versterken.
Op 23 juli kondigden AMD en Cerebras een technische samenwerking aan rond een gedisaggregeerde AI-inferentiearchitectuur . Dat betekent dat verschillende onderdelen van het proces op gespecialiseerde systemen kunnen draaien, in plaats van op één allesomvattende machine.
In de gezamenlijke opzet werken AMD Helios en Cerebras' Wafer-Scale Engine samen als één inferentieworkflow. AMD-gpu's verwerken taken met een hoge doorvoersnelheid, terwijl Cerebras zich richt op het snel genereren van tokens — de kleine tekstonderdelen waaruit een AI-antwoord wordt opgebouwd .
Klanten kunnen hun inferentieworkloads zo verdelen over beide systemen, met name voor complexe toepassingen waarbij een lage reactiesnelheid belangrijk is. De gezamenlijke oplossing moet in de tweede helft van 2026 eerst via Cerebras Cloud beschikbaar komen .
| Kenmerk | AMD Helios | Nvidia Vera Rubin NVL72 |
|---|---|---|
| Prijs per rack | 5–5,5 miljoen dollar | Niet officieel bekendgemaakt |
| Gpu's per rack | 72 MI455X-gpu's | 72 Rubin-gpu's |
| Geheugen per gpu | 288 GB HBM3E | Ongeveer 288 GB, volgens de aangehaalde vergelijking |
| Totaal geheugen per rack | Ongeveer 20,7 TB | Ongeveer 20,7 TB aan ruwe capaciteit |
| Bandbreedte | AMD claimt een voordeel per gpu | Nvidia heeft een sterke interconnect via NVLink |
| AI-training | Volgens analisten achter Nvidia | Leidend volgens de aangehaalde analyses |
| Software | ROCm, open-source en groeiend | CUDA, volwassen en dominant |
| Geschat marktaandeel in 2026 | Ongeveer 5–7 procent | Ongeveer 80 procent |
De belangrijkste verandering is niet alleen de specificatie van de rack, maar het moment waarop die beschikbaar komt. Helios wordt in dezelfde aanschafcyclus aangeboden als Vera Rubin. Voor AMD betekent dat de eerste rechtstreekse confrontatie tussen een eigen rack-scale AI-systeem en Nvidia's nieuwste rackplatform .
AMD heeft Nvidia daarmee nog niet van de troon gestoten. Wel probeert het bedrijf de markt open te breken met een alternatief dat grote klanten meer keuze moet geven — en dat tegelijk hardware, netwerken, processors en software in één pakket aanbiedt.