Samtidig har Microsoft allerede meldt ud, at Azure også tager Nvidias Vera Rubin NVL72-systemer i brug . Strategien er dermed klar: Microsoft vil have adgang til begge de førende AI-hardwareplatforme i stedet for at gøre sig afhængig af én leverandør.
Microsoft forsøger at mindske risikoen i forsyningskæden og undgå en fastlåsning til én hardwareleverandør . Det passer med selskabets bredere tilgang til at understøtte flere modeller og teknologier i Azure og Copilot .
Microsofts administrerende direktør, Satya Nadella, har sagt, at Azure vil være blandt de første cloududbydere til at implementere næste generations rack-baserede AI-infrastruktur fra både AMD og Nvidia .
For Microsoft kan det give større fleksibilitet, hvis en af leverandørerne får problemer med produktion eller kapacitet. Samtidig kan to konkurrerende platforme styrke selskabets forhandlingsposition. I branchen beskrives tilgangen ofte som at “sprede sine chancer” på AI-infrastrukturen .
Hverken AMD eller Microsoft har offentliggjort den faktiske pris eller størrelsen på Microsofts Helios-ordre. Futurum Groups analytikere anslår dog følgende priser pr. rack:
På rack-for-rack-basis gør det Helios omkring 40 procent dyrere end Vera Rubin . Prisforskellen afspejler ifølge vurderinger blandt andet Helios’ større hukommelseskapacitet, en mere åben arkitektur og AMDs samlede kombination af GPU’er, CPU’er og netværkskomponenter .
AMD mener, at den højere indkøbspris kan opvejes af bedre effektivitet i drift. Ifølge AMDs egne laboratoriemålinger leverer Helios blandt andet:
AMD-chef Lisa Su præsenterede tallene ved arrangementet Advancing AI 2026 og sagde, at Helios leverer mindst 15 procent højere ydelse på de største modeller, 50 procent mere HBM-hukommelse og op til 30 procent flere tokens pr. dollar end konkurrenten .
Tallene skal dog læses med forbehold. Futurum Group understreger, at AMDs sammenligning bygger på leverandørens egne beregninger mod en konkurrerende platform, der endnu ikke er sendt på markedet. Påstandene om 15 procent højere ydelse og 30 procent flere tokens pr. dollar skal derfor først efterprøves i produktion .
Helios er AMDs første komplette rack-baserede AI-system. Det er væskekølet og samler acceleratorer, processorer og netværk i en samlet platform .
| Komponent | Specifikation |
|---|---|
| GPU’er | 72 AMD Instinct MI455X |
| GPU-arkitektur | CDNA 5, baseret på en hybrid af 2- og 3-nanometer-chiplets hos TSMC |
| Transistorer pr. GPU | 320 milliarder |
| CPU’er | 18 sjettegenerations AMD EPYC “Venice”, én pr. compute-tray |
| Netværk | AMD Pensando “Vulcano” 800 AI-NIC’er med 800 Gbit/s Ethernet |
| Forbindelse internt i racket | UALink, transporteret over Ethernet |
| Forbindelse mellem racks | Tilpasset specifikationerne fra Ultra Ethernet Consortium |
| Samlet HBM4-hukommelse | 31 TB pr. rack |
| Hukommelse pr. GPU | 432 GB, fordelt på 12 HBM4-stakke á 36 GB |
| Hukommelsesbåndbredde pr. GPU | 19,6 TB/s |
| Samlet hukommelsesbåndbredde | 1,7 PB/s pr. rack |
| FP4-ydelse | 2,9 exaFLOPS pr. rack |
| FP8-ydelse | 1,4 exaFLOPS pr. rack |
| Scale-up-båndbredde | 260 TB/s |
| Scale-out-båndbredde | 43 TB/s |
| Format | 18 væskekølede compute-trays med fire GPU’er hver samt seks switch-trays |
| Ydelse pr. GPU | 40 PFLOPS FP4 og 20 PFLOPS FP8 |
Hver compute-tray har fire MI455X-GPU’er, én EPYC Venice-processor og Pensando-netværk. Via UALink kan de 72 GPU’er arbejde som én samlet beregningsenhed .
Den store mængde HBM4-hukommelse er især vigtig ved inferens på store modeller. Når modellen kan ligge tættere på acceleratorerne, kan behovet for at flytte data mellem hukommelse og beregningsenheder reduceres – en faktor, der har direkte betydning for gennemløb og pris pr. token .
AMD har offentliggjort en række tidlige Helios-kunder:
Anthropic er derimod ikke offentligt blevet nævnt som en tidlig Helios-kunde i de større annonceringer frem til juli 2026 .
Microsofts dobbelte satsning viser, at kampen om AI-infrastruktur ikke længere kun handler om, hvilken GPU der er hurtigst. Cloududbydere forsøger også at sikre leverancer, holde flere teknologiske muligheder åbne og forhandle med flere leverandører .
AMD Helios’ åbne, Ethernet-baserede forbindelser og store HBM4-kapacitet er særligt målrettet store inferensopgaver. Men den afgørende test kommer først, når systemerne kører i produktion, og uafhængige målinger kan sammenligne Helios og Vera Rubin under reelle belastninger.
AMD forventer, at Helios sendes i anden halvdel af 2026. Indtil da er AMDs ydelses- og pris-påstande lovende, men stadig delvist baseret på leverandørens egne modeller .