Teza stojąca za tą dramatyczną korektą jest prosta: rewolucja AI przechodzi z fazy uczenia do wnioskowania, a przyszłe obciążenia — autonomiczne, wieloetapowe systemy agentowej AI — wymagają znacznie większej mocy obliczeniowej procesorów, niż wcześniej oczekiwano w branży .
Obciążenia agentowej AI mają stanowić około dwóch trzecich rynku procesorów serwerowych o wartości 220 miliardów dolarów do 2030 roku . Systemy te autonomicznie realizują złożone zadania, w dużym stopniu polegając na procesorach do zarządzania danymi i koordynacji obok wykonywania modeli na GPU .
Wnioskowanie stało się dominującym przypadkiem użycia mocy obliczeniowej AI. W 2026 r., po raz pierwszy, obciążenia związane z wnioskowaniem pochłaniają około 60% globalnej mocy obliczeniowej AI, przewyższając tym samym uczenie . To przesunięcie sprzyja architekturom opartym na procesorach, ponieważ udostępnianie modeli na dużą skalę wymaga ogromnej liczby procesorów serwerowych, serwerów wnioskujących i otaczającej je infrastruktury .
AMD widzi również szerszy rynek obliczeń o wysokiej wydajności i obliczeń adaptacyjnych sięgający 2 bilionów dolarów do 2030 roku, w porównaniu z 365 miliardami dolarów w 2025 roku . Sam rynek układów scalonych do centrów danych ma przekroczyć 1 bilion dolarów .
Ogłoszony 23 lipca 2026 r. podczas Advancing AI 2026, Helios to pierwszy w pełni zintegrowany, chłodzony cieczą system AI AMD w skali racka, łączący 72 akceleratory Instinct MI455X, procesory EPYC Venice i sieć Pensando . Jest w pełnej produkcji od lipca 2026 r., a wysyłki dla partnerów rozpoczną się pod koniec trzeciego kwartału 2026 r. (wrzesień 2026 r.), ze znaczącym wzrostem wolumenu w czwartym kwartale .
System oferuje do 2,9 eksaflopsów przepustowości wnioskowania FP4 i 1,4 eksaflopsa przepustowości uczenia FP8, z przepustowością interkonektu skalowania w górę wynoszącą 260 TB/s . Szacunkowa cena w pełni wyposażonej szafy Helios wynosi około 5,25 miliona dolarów .
Zbudowany w procesie N2 (2nm) TSMC, procesor Venice oferuje do 256 rdzeni na gniazdo dzięki umieszczeniu 32 rdzeni Zen 6c na każdym z 8 układów chiplets . Produkcja ruszyła w zakładzie TSMC na Tajwanie w maju 2026 r., a przyszła produkcja jest planowana w zakładzie TSMC w Arizonie (choć znaczące wolumeny nie są tam oczekiwane przed 2028 r.) .
Procesory Venice są obecnie udostępniane klientom do testów i będą wysyłane w systemach Helios, a także w osobnych wdrożeniach serwerowych pod koniec 2026 r. i na początku 2027 r. . Wariant EPYC 9006 SP7, zaprojektowany do wykonywania agentów AI w izolowanym środowisku, ma być wysyłany w czwartym kwartale 2026 roku .
Firma AMD pozyskała znaczące zobowiązania od trzech wiodących firm AI, łącznie około 14 gigawatów mocy obliczeniowej :
| Klient | Zobowiązanie | Szczegóły |
|---|---|---|
| OpenAI | ~6 GW | Umowa ogłoszona w październiku 2025 r. Około 10% akcji AMD wyemitowane jako warranty wynikowe. OpenAI spodziewa się uruchomić Helios online od czwartego kwartału 2026 r. . |
| Meta | ~6 GW | Umowa ogłoszona w lutym 2026 r. Obejmuje niestandardowe układy MI450-series i współtworzoną architekturę Helios za pośrednictwem Open Compute Project. Meta wciąż waliduje platformy EPYC i testuje systemy Helios . |
| Anthropic | Do 2 GW | Umowa ogłoszona w lipcu 2026 r. AMD zobowiązało się do strategicznej inwestycji kapitałowej w wysokości do 5 miliardów dolarów. Oczekuje się, że pierwszy gigawat mocy obliczeniowej GPU MI450-series zostanie dostarczony w pierwszej połowie 2027 r. . |
Dodatkowi klienci to Microsoft (wdrażający systemy Helios w centrach danych Azure) i Oracle (budujący superklaster Helios z 50 000 procesorów GPU) .
Stos programowy AMD ROCm poczynił znaczne postępy, ale wciąż ustępuje CUDA firmy Nvidia w kluczowych obszarach:
Co działa:
Pozostałe luki:
Konkluzja: ROCm jest teraz produkcyjnie opłacalny do wnioskowania i konkurencyjny pod względem ceny za token (podobno 25–40% tańszy od Nvidii w przypadku obciążeń wnioskowania na równoważnym sprzęcie), ale CUDA utrzymuje znaczącą przewagę w narzędziach, przepływach pracy uczenia i szerokości wsparcia frameworków .
Wyniki AMD za drugi kwartał 2026 r. mocno wspierają strategiczny kierunek firmy:
| Wskaźnik | Q2 2026 | Zmiana rok do roku |
|---|---|---|
| Całkowity przychód | 11,5 miliarda USD | Rekordowy poziom |
| Przychód z centrów danych | 6,7 miliarda USD | Ponad dwukrotny wzrost |
| Centra danych jako % całości | ~58% | Wzrost z 42% rok wcześniej |
| Wzrost przychodów z CPU serwerowych | >70% | Napędzany wnioskowaniem/agentową AI |
Kierownictwo podczas telekonferencji wynikowej zauważyło, że „wnioskowanie i agentowa AI zwiększają zapotrzebowanie na moc obliczeniową procesorów serwerowych” jako strukturalny czynnik napędzający podwyższony szacunek TAM . AMD oczekuje, że przychody z centrów danych z AI osiągną „kilkadziesiąt miliardów dolarów” do 2027 roku, a same przychody z procesorów serwerowych wzrosną o ponad 70% w 2027 roku .
Trajektoria marży brutto: W miarę jak AMD przechodzi ze sprzedaży pojedynczych układów scalonych do zintegrowanych systemów w skali racka, takich jak Helios — które łączą w jednym pakiecie GPU, CPU i sieć — łączne marże mogą napotkać przeciwności w porównaniu do sprzedaży samych układów. Rynek obserwuje, czy AMD będzie w stanie utrzymać ekspansję marż, stając się dostawcą systemów, podobnie jak Nvidia.
Koncentracja łańcucha dostaw TSMC: AMD polega na TSMC w przypadku produkcji zarówno najnowocześniejszych CPU (N2), jak i GPU (N3/N4) . Produkcja Venice rozpędza się w TSMC na Tajwanie. Chociaż AMD zaplanowało przyszłą produkcję w zakładzie TSMC w Arizonie, ta moc produkcyjna nie jest jeszcze dostępna dla najnowocześniejszych węzłów . Napięcia geopolityczne wokół Tajwanu oraz konkurencja o alokację wafli TSMC ze strony Apple, Nvidii i innych pozostają istotnym, krótkoterminowym ryzykiem, zwłaszcza że AMD planuje wysyłki Helios na skalę gigawatową od końca 2026 roku.
AMD realizuje jasną, ambitną strategię, która opiera się na punkcie zwrotnym w obciążeniach AI — od uczenia do wnioskowania, od izolowanych modeli do autonomicznych agentów. Mapa drogowa sprzętu (Helios i Venice) jest w produkcji, najwięksi klienci zobowiązali się na niespotykaną dotąd skalę, a wyniki finansowe odzwierciedlają tę zmianę. Kluczowe otwarte pytania to, czy ROCm zdoła wystarczająco szybko zamknąć pozostałą lukę względem CUDA i czy ograniczenia łańcucha dostaw pozwolą AMD dotrzymać agresywnego harmonogramu zwiększania skali produkcji.