De redenering achter deze dramatische opwaardering is eenvoudig: de AI-revolutie verschuift van training naar inferentie, en de werkbelastingen van de toekomst — autonome, meerstaps-agentic AI-systemen — vereisen veel meer CPU-rekenkracht dan de industrie eerder had verwacht .
Agentic AI-werkbelastingen zullen naar verwachting ongeveer tweederde van de $220 miljard aan server-CPU-markt in 2030 uitmaken . Deze systemen orkestreren autonoom complexe taken en vertrouwen zwaar op CPU's voor gegevensverwerking en coördinatie, naast GPU-gebaseerde modeluitvoering .
Inferentie is de dominante AI-gebruikssituatie geworden. In 2026 wordt voor het eerst ongeveer 60% van de wereldwijde AI-rekenkracht gebruikt voor inferentie, waarmee training wordt overtroffen . Deze verschuiving is gunstig voor CPU-intensieve architecturen, omdat het op schaal aanbieden van modellen een groot aantal host-CPU's, inferentieservers en ondersteunende infrastructuur vereist .
AMD ziet ook de bredere high-performance en adaptieve computermarkt tegen 2030 $2 biljoen bedragen, tegenover $365 miljard in 2025 . Alleen al de markt voor silicium in datacenters zal naar verwachting de $1 biljoen overschrijden .
Helios, aangekondigd op Advancing AI 2026 op 23 juli 2026, is AMD's eerste volledig geïntegreerde, vloeistofgekoelde rack-schaal AI-systeem. Het combineert 72 Instinct MI455X GPU's, EPYC Venice CPU's en Pensando-netwerken . Het is in volledige productie sinds juli 2026, met partnerverzendingen vanaf eind Q3 2026 (september 2026) en volumegroei in Q4 .
Het rack levert tot 2,9 exaflops aan FP4-inferentiedoorvoer en 1,4 exaflops aan FP8-trainingsdoorvoer, met een interconnectbandbreedte van 260 TB/s . De prijs voor een volledig uitgerust Helios-rack wordt geschat op ongeveer $5,25 miljoen .
De Venice CPU, gebouwd op TSMC's N2 (2nm)-proces, heeft tot wel 256 kernen per socket door 32 Zen 6c-kernen op elk van de 8 chiplets te plaatsen . De productieramp bij TSMC Taiwan begon in mei 2026, met toekomstige productie gepland in TSMC's faciliteit in Arizona (hoewel daar pas in 2028 volume wordt verwacht) .
Venice wordt momenteel aan klanten bemonsterd en zal later in 2026 en begin 2027 worden geleverd in zowel Helios-racks als zelfstandige serverimplementaties . De EPYC 9006 SP7-variant, gebouwd voor hoge-dichtheid agent-sandbox-uitvoering, zal naar verwachting in het vierde kwartaal van 2026 worden verzonden .
AMD heeft aanzienlijke verplichtingen binnengehaald van de drie toonaangevende AI-bedrijven, in totaal ongeveer 14 gigawatt aan rekenkracht :
| Klant | Verplichting | Details |
|---|---|---|
| OpenAI | ~6 GW | Deal aangekondigd in oktober 2025. ~10% van AMD's aandelen uitgegeven als prestatiewarrants. OpenAI verwacht Helios online te hebben vanaf Q4 2026 . |
| Meta | ~6 GW | Deal aangekondigd in februari 2026. Omvat aangepaste MI450-serie chips en mede-ontwikkelde Helios-rackarchitectuur via het Open Compute Project. Meta valideert nog steeds EPYC-platforms en test Helios-systemen . |
| Anthropic | Tot 2 GW | Deal aangekondigd in juli 2026. AMD heeft een strategische aandeleninvestering van maximaal $5 miljard toegezegd. Naar verwachting wordt de eerste gigawatt aan MI450-serie GPU-capaciteit verzonden in H1 2027 . |
Extra klanten zijn Microsoft (dat Helios-racks in Azure-datacenters implementeert) en Oracle (dat een 50.000-GPU Helios-supercluster bouwt) .
AMD's ROCm-softwarestack heeft aanzienlijke vooruitgang geboekt, maar blijft nog steeds achter bij Nvidia's CUDA op belangrijke gebieden:
Wat werkt:
Resterende hiaten:
Conclusie: ROCm is nu productiegeschikt voor inferentie en concurrerend op prijs-per-token (naar verluidt 25–40% goedkoper dan Nvidia voor inferentiewerkbelastingen op gelijkwaardige hardware), maar CUDA behoudt een betekenisvolle voorsprong in tooling, trainingsworkflows en de breedte van framework-ondersteuning .
AMD's Q2 2026 resultaten ondersteunen de strategische richting van het bedrijf sterk:
| Metriek | Q2 2026 | Jaar-op-jaar Verandering |
|---|---|---|
| Totale omzet | $11,5 miljard | Recordhoogte |
| Data center omzet | $6,7 miljard | Meer dan verdubbeld |
| Data center als % van totaal | ~58% | Gestegen van 42% een jaar eerder |
| Server CPU omzetgroei | >70% | Gedreven door inferentie/agentic AI |
Het management merkte tijdens de earnings call op dat "inferentie en agentic AI de behoefte aan server-CPU-rekenkracht vergroten" als de structurele drijfveer achter de verhoogde TAM . AMD verwacht dat de data center AI-omzet tegen 2027 "tientallen miljarden dollars" zal bedragen, waarbij alleen al de server-CPU-omzet in 2027 naar verwachting met meer dan 70% zal groeien .
Brutomarge-traject: Naarmate AMD verschuift van het verkopen van losse chips naar geïntegreerde rackschaal systemen zoals Helios — die GPU's, CPU's en netwerken in één pakket bundelen — kunnen de samengestelde marges onder druk komen te staan in vergelijking met pure chipverkopen. De markt kijkt of AMD de marge-uitbreiding kan volhouden terwijl het meer een systeemleverancier wordt, vergelijkbaar met Nvidia.
TSMC-toeleveringsketenconcentratie: AMD is voor zowel geavanceerde CPU- (N2) als GPU- (N3/N4) productie afhankelijk van TSMC . Venice wordt opgeschaald bij TSMC Taiwan, en hoewel AMD toekomstige productie heeft gepland in TSMC's Arizona-fabriek, is die capaciteit nog niet online voor geavanceerde nodes . Geopolitieke spanningen rond Taiwan en concurrentie voor TSMC-wafers van Apple, Nvidia en anderen blijven materiële risico's op korte termijn, vooral omdat AMD van plan is Helios op gigawattschaal te verschepen vanaf eind 2026.
AMD voert een duidelijke, ambitieuze strategie uit die afhangt van een keerpunt in AI-werkbelastingen — van training naar inferentie, van geïsoleerde modellen naar autonome agenten. De hardware-roadmap (Helios en Venice) is in productie, de grootste klanten hebben zich op ongekende schaal gecommitteerd en de financiële resultaten weerspiegelen de verschuiving. De belangrijkste open vragen zijn of ROCm de resterende kloof met CUDA snel genoeg kan dichten en of de beperkingen in de toeleveringsketen AMD in staat zullen stellen het agressieve opschalingsschema te halen.