Taka zdezagregowana konstrukcja pozwala, aby każdy podetap inferencji działał na optymalnym dla niego krzemie. AMD dostarcza logikę CPU/GPU o niskim opóźnieniu do ogólnych zadań, podczas gdy procesor waflowy Cerebras zapewnia ogromną moc równoległą do wykonywania podstawowego modelu . Dyrektor generalna AMD, Lisa Su, określiła to partnerstwo jako część szerszego trendu wykorzystywania różnych układów do różnych etapów potoku inferencji
.
Firmy twierdzą, że wspólna platforma zapewnia znacznie krótszy czas odpowiedzi dla złożonych aplikacji AI w porównaniu z monolityczną inferencją opartą na GPU. Oficjalne komunikaty opisują ją jako dostarczającą „wiodącą w branży, ultraniską latencję i wysoką przepustowość inferencji AI” . Konkretne dane porównawcze (np. tokeny na sekundę czy opóźnienia w milisekundach) nie zostały szczegółowo opublikowane podczas wydarzenia. Dzień po ogłoszeniu akcje Cerebras wzrosły o około 6%
.
Wspólne rozwiązanie ma być dostępne za pośrednictwem Cerebras Cloud jeszcze w 2026 roku. Cerebras planuje wdrożyć systemy AMD Helios we własnych centrach danych, aby świadczyć tę usługę .
Podczas wydarzenia AMD oficjalnie uruchomiło Heliosa, swój pierwszy skalowalny system AI. CEO Lisa Su nazwała go „najpotężniejszym rackiem AI na świecie” i potwierdziła, że jest już w pełnej produkcji . Kluczowe specyfikacje obejmują:
Helios jest bezpośrednim konkurentem dla systemów Nvidia DGX i HGX, a AMD twierdzi, że oferuje lepszą wydajność zarówno w przypadku uczenia, jak i inferencji AI .
Nadrzędnym przesłaniem konferencji Advancing AI 2026 było odejście od polegania na jednym typie GPU na każdym etapie obciążenia. Branża zmierza w kierunku zdezagregowanych, zoptymalizowanych pod kątem obciążeń architektur, które dzielą przetwarzanie wstępne, inferencję i przetwarzanie końcowe na wyspecjalizowane układy różnych dostawców. AMD przedstawiło Heliosa i partnerstwo z Cerebras jako wielodostawcową, otwartą alternatywę dla pionowo zintegrowanego podejścia Nvidii .
Oprócz partnerstwa z Cerebras i premiery Heliosa, AMD dokonało kilku innych znaczących ogłoszeń:
AMD ujawniło, że na początku tego samego tygodnia, jeszcze przed konferencją, pozyskało klienta w postaci firmy Anthropic. Anthropic dołączył do listy głównych laboratoriów AI, które zobowiązały się do masowego wdrażania sprzętu AMD (w tym systemów Helios). Jest to część szerszego trendu dywersyfikacji przez czołowe firmy AI od monopolu GPU Nvidii .
Cerebras miał udany rok niezależnie od partnerstwa z AMD. Firma zadebiutowała na giełdzie 14 maja 2026 na Nasdaq pod tickerem CBRS. Wyceniła 30 milionów akcji po 185 dolarów za sztukę, czyli znacznie powyżej początkowo oczekiwanego przedziału 115–125 dolarów, pozyskując 5,55 miliarda dolarów w największym amerykańskim technologicznym IPO 2026 roku. Akcje wzrosły o 68% pierwszego dnia handlu, zamykając się na poziomie 311,07 dolarów .
W styczniu 2026 roku OpenAI i Cerebras ogłosiły wieloletnią umowę na dostawę mocy obliczeniowej o wartości do 750 megawatów. Początkowe zobowiązanie opiewało na około 10 miliardów dolarów, później rozszerzone do ponad 20 miliardów dolarów (z potencjalnym limitem 30 miliardów dolarów). OpenAI miało również otrzymać w ramach umowy pakiet udziałów w Cerebras sięgający do 10% .