Strategin minskar risken för störningar i leveranskedjan och begränsar inlåsningen till en enda hårdvaruplattform . Den ligger också i linje med Microsofts mer leverantörsoberoende syn på modeller och AI-tjänster i Azure och Copilot .
Microsofts vd Satya Nadella har sagt att företaget ska vara bland de första molnleverantörerna att bygga ut nästa generations rackbaserade AI-infrastruktur med både AMD Helios och Nvidia Vera Rubin . I praktiken ger det Microsoft större flexibilitet om någon av leverantörerna får svårt att leverera tillräckligt många system – och ett bättre förhandlingsläge kring pris och kapacitet.
Varken AMD eller Microsoft har offentliggjort det faktiska priset i affären. En uppskattning från Futurum Group placerar däremot kostnaden för ett AMD Helios-rack på 5–5,5 miljoner dollar. Nvidias Vera Rubin NVL72 uppskattas till 3,5–4 miljoner dollar per rack .
Det innebär att Helios på racknivå är ungefär 40 procent dyrare. Prispåslaget kopplas bland annat till den större minneskapaciteten, den Ethernet-baserade och mer öppna arkitekturen samt AMD:s integrerade kombination av GPU:er, processorer och nätverkskomponenter .
AMD hävdar samtidigt att den högre investeringen kan vägas upp av lägre kostnad i själva AI-driften. Företagets egna laboratoriemätningar pekar på följande jämförelse med Vera Rubin NVL72:
AMD:s vd Lisa Su beskrev vid Advancing AI 2026 Helios som ett system med minst 15 procent högre prestanda för de största modellerna, 50 procent mer HBM-minne och upp till 30 procent fler token per dollar .
Siffrorna bör dock läsas med viss försiktighet. Futurum Group påpekar att AMD:s jämförelse bygger på leverantörens egna beräkningar mot en konkurrerande produkt som ännu inte har levererats i stor skala. Påståendena om 15 procents prestandaförsprång och 30 procent fler token per dollar behöver därför verifieras i verklig drift .
Helios är AMD:s första kompletta rackbaserade AI-system. Det är vätskekylt och byggt för att fungera som en sammanhängande beräkningsplattform snarare än som en samling fristående servrar .
| Komponent | Specifikation |
|---|---|
| GPU:er | 72 AMD Instinct MI455X |
| GPU-arkitektur | CDNA 5, med chipletdesign på 2 och 3 nanometer hos TSMC |
| Transistorer per GPU | 320 miljarder |
| CPU:er | 18 AMD EPYC Venice, sjätte generationen – en per beräkningssläde |
| Nätverk | AMD Pensando Vulcano 800 AI-NIC:er, Ethernet på 800 Gbit/s och upp till 2,4 Tbit/s scale-out per GPU |
| Kommunikation inom racket | UALink, transporterat över Ethernet |
| Kommunikation mellan rack | Anpassad till specifikationer från Ultra Ethernet Consortium |
| Totalt HBM4-minne | 31 TB per rack |
| HBM4 per GPU | 432 GB, fördelat på tolv stackar om 36 GB |
| Minnesbandbredd per GPU | 19,6 TB/s |
| Samlad minnesbandbredd | 1,7 PB/s per rack |
| FP4-prestanda | 2,9 exaFLOPS per rack |
| FP8-prestanda | 1,4 exaFLOPS per rack |
| Scale-up-bandbredd | 260 TB/s |
| Scale-out-bandbredd | 43 TB/s |
| Konstruktion | 18 vätskekylda beräkningsslädar med fyra GPU:er vardera samt sex switchslädar |
Varje beräkningssläde kopplar samman fyra MI455X-GPU:er med en EPYC Venice-processor och Pensando-nätverk. Via UALink kan de 72 GPU:erna arbeta som en gemensam beräkningsenhet .
AMD har offentligt nämnt flera tidiga Helios-kunder:
Anthropic har däremot inte offentligt pekats ut som en tidig Helios-kund i de större tillkännagivandena som fanns tillgängliga i juli 2026 . Det finns alltså stöd för OpenAI, Meta och Oracle – men inte för att Anthropic har valt Helios.
Microsofts dubbla satsning visar hur AI-infrastrukturen håller på att förändras. De stora molnleverantörerna köper inte längre nödvändigtvis all kapacitet från en enda chiptillverkare. I stället kombinerar de plattformar för att säkra leveranser, skapa konkurrens mellan leverantörer och välja hårdvara efter arbetsbelastning .
Helios stora minnesmängd och Ethernet-baserade sammankoppling kan vara särskilt intressanta för inferens, där minneskapacitet och bandbredd påverkar hur snabbt modeller svarar och vad varje token kostar . AMD väntas börja leverera systemet under andra halvåret 2026. Den verkliga prövningen kommer när Helios och Vera Rubin används i produktion och oberoende prestandamätningar kan jämföra löftena med faktisk kapacitet .