Helios er ikke blot en ny GPU, men en samlet platform med grafikprocessorer, server-CPU'er, netværk og software. Hvert rack består ifølge AMD af:
MI455X er den centrale accelerator i systemet og AMD's mest avancerede AI-chip i denne produktgeneration . Lisa Su kaldte Helios for »verdens bedste AI-rack« og for branchens mest højtydende rack til træning og kørsel af såkaldte frontier-modeller i stor skala . Det er AMD's egen vurdering, ikke en uafhængig benchmark.
AMD oplyste samtidig, at Helios allerede er i fuld produktion og bliver leveret i samme indkøbsvindue som Nvidias Vera Rubin NVL72 . Den angivne pris er 5-5,5 mio. dollar pr. rack, svarende til cirka 5,25 mio. dollar ved midtpunktet .
Den sjette generation af EPYC, med kodenavnet Venice, bygger på Zen 6 og er ifølge AMD branchens første x86-serverprocessor fremstillet på TSMC's 2-nanometer-proces . Processoren blev lanceret kommercielt på konferencen og fungerer som CPU-rygraden i Helios' compute-trays.
Venice kan skalere til 256 Zen 6-kerner . I Helios skal CPU'en blandt andet koordinere arbejdet mellem GPU'erne og resten af systemet, så platformen kan fungere som en samlet infrastruktur til både træning og såkaldt inference – altså når en færdig AI-model genererer svar.
AMD fremhævede især Helios' hukommelseskapacitet og båndbredde som en fordel i forhold til Nvidias Vera Rubin NVL72. Hver MI455X-GPU har 288 GB HBM3E-hukommelse, og de 72 GPU'er giver tilsammen en stor fælles hukommelsespulje .
AMD hævder, at Helios leverer:
Den store hukommelsesmængde kan være særlig relevant ved inference, hvor store modeller i højere grad kan holdes i hukommelsen. Sammenligningen er dog ikke entydig: analytikere vurderer fortsat, at Nvidia har et forspring inden for træningsydelse og især softwareøkosystemet omkring CUDA .
AMD nævnte en række store cloud-udbydere, AI-laboratorier og teknologivirksomheder som kunder, samarbejdspartnere eller brugere, der tester selskabets platforme .
| Kunde | Oplyst anvendelse eller omfang |
|---|---|
| Microsoft Azure | Ankerkunde for Helios; leverancer begynder i andet halvår af 2026 |
| OpenAI | Op til 6 gigawatt AMD-infrastruktur; Helios-racks er allerede i brug |
| Meta | OpenAI og Meta har tilsammen planlagt 12 gigawatt AMD-acceleratorkapacitet |
| Oracle | Nævnt som en tidlig Helios-kunde |
| Anthropic | Op til 2 gigawatt Helios-infrastruktur |
| AT&T | Adopterer eller tester AMD-platforme |
| Cisco | Adopterer eller tester AMD-platforme |
AMD's officielle meddelelse nævnte også Cerebras som samarbejdspartner . Gigawatt-tallene beskriver i denne sammenhæng den planlagte strøm- og datacenterkapacitet til AI-infrastruktur – ikke antallet af chips.
Den mest opsigtsvækkende aftale kom den første dag af konferencen, den 22. juli. AMD vil foretage en strategisk aktieinvestering på op til 5 mia. dollar i Anthropic, AI-virksomheden bag Claude .
Som en del af aftalen vil Anthropic implementere op til 2 gigawatt AMD Instinct MI450-serie-GPU'er i Helios-racks . Den første gigawatt skal efter planen tages i brug i første halvår af 2027 .
Anthropic-medstifter Tom Brown fremhævede integration og ydeevne som årsager til samarbejdet. Virksomhederne vil desuden samarbejde om AI-sikkerhed og cybersikkerhed . Aftalen er dermed både en kapitalinvestering og en stor, flerårig aftale om AI-kapacitet.
Den 23. juli offentliggjorde AMD et teknisk partnerskab med Cerebras om en såkaldt disaggregeret inference-arkitektur . Det betyder, at forskellige dele af AI-arbejdet fordeles på specialiseret hardware i stedet for at blive håndteret af ét samlet system.
I den fælles løsning skal AMD Helios og Cerebras' Wafer-Scale Engine fungere som én arbejdsgang. AMD's Instinct-GPU'er skal levere højt gennemløb, mens Cerebras-systemet skal stå for hurtig generering af tokens – de tekststykker, som en sprogmodel producerer .
Kunder vil dermed kunne fordele inference-opgaver mellem de to platforme, hvilket især er rettet mod komplekse AI-tjenester, hvor svartiden er afgørende . Den fælles løsning ventes først at blive tilgængelig gennem Cerebras Cloud i andet halvår af 2026 .
| Parameter | AMD Helios | Nvidia Vera Rubin NVL72 |
|---|---|---|
| Pris pr. rack | 5-5,5 mio. dollar | Ikke officielt oplyst |
| GPU'er pr. rack | 72 MI455X | 72 Rubin-GPU'er |
| Hukommelse pr. GPU | 288 GB HBM3E | Cirka 288 GB, ifølge den foreliggende sammenligning |
| Samlet rack-hukommelse | Cirka 20,7 TB | Cirka 20,7 TB, rå kapacitet |
| Båndbredde | AMD hævder højere GPU-båndbredde | Høj interconnect-båndbredde via NVLink |
| Træningsydelse | Vurderes fortsat efter Nvidia | Førende ifølge de citerede analyser |
| Software | ROCm, open source og i vækst | CUDA, modent og dominerende |
| Estimeret markedsandel i 2026 | Cirka 5-7 procent | Cirka 80 procent |
Nvidias rackpris er ikke officielt offentliggjort, så en direkte pris-performancesammenligning er endnu usikker. Det centrale skifte er snarere, at AMD nu har et rackskaleret system, der sendes ind i den samme indkøbscyklus som Nvidias nyeste platform .
AMD har ikke med ét arrangement fjernet Nvidias forspring. CUDA-økosystemet, træningsydelsen og Nvidias markedsandel er fortsat betydelige styrker . Men Helios ændrer konkurrencen fra enkeltstående acceleratorer til komplette AI-racks, som store cloud-udbydere kan købe og skalere direkte.
Anthropic-aftalen på op til 5 mia. dollar og Cerebras-samarbejdet viser samtidig, at AMD forsøger at løse to af sine største udfordringer på én gang: at skaffe store kunder og at gøre hele software- og inference-oplevelsen mere attraktiv. Om det er nok til at flytte markedsandele, afhænger i sidste ende af de faktiske leverancer, ydelsen i drift og hvor let ROCm kan konkurrere med CUDA.