La piattaforma utilizza un approccio a livelli per l'inferenza. Le CPU EPYC e le GPU Instinct di AMD (all'interno dei rack Helios) gestiscono le fasi iniziali: pre-elaborazione delle richieste, tokenizzazione e gestione di finestre di contesto ampie. Il WSE di Cerebras subentra poi per la fase più intensiva dal punto di vista computazionale: la generazione veloce di token, che richiede un'enorme larghezza di banda di memoria e throughput parallelo .
Questo design disaggregato consente a ogni sotto-attività di inferenza di essere eseguita sul silicio più adatto. AMD fornisce la logica CPU/GPU a bassa latenza per le fasi generiche, mentre il chip wafer-scale di Cerebras offre la potenza di calcolo parallela massiccia per l'esecuzione del modello principale . L'amministratore delegato di AMD, Lisa Su, ha descritto la partnership come parte di un cambiamento più ampio verso l'utilizzo di chip diversi per diverse fasi della pipeline di inferenza .
Le aziende affermano che la piattaforma congiunta offre tempi di risposta significativamente inferiori per applicazioni AI complesse rispetto all'inferenza basata su GPU monolitiche. Il linguaggio ufficiale la descrive come in grado di fornire "inferenza AI a latenza ultra-bassa e throughput elevato leader del settore" . Non sono stati pubblicati numeri di benchmark specifici, come token al secondo o latenza in millisecondi, in dettaglio durante l'evento. Il titolo di Cerebras è salito di circa il 6% il giorno dell'annuncio .
Si prevede che l'offerta congiunta sarà disponibile tramite Cerebras Cloud entro la fine del 2026. Cerebras prevede di implementare i sistemi AMD Helios nei propri data center per ospitare il servizio .
AMD ha anche lanciato ufficialmente Helios, il suo primo sistema AI su scala rack, all'evento. L'Amministratore Delegato Lisa Su lo ha definito "il rack AI più potente del mondo" e ne ha confermato la piena produzione . Le specifiche principali includono:
Helios si posiziona come concorrente diretto dei sistemi rack DGX e HGX di Nvidia, con AMD che rivendica prestazioni superiori sia nei carichi di lavoro di training che di inferenza AI .
Il messaggio principale dell'evento Advancing AI 2026 è stato che il mercato dell'inferenza AI si sta allontanando dall'uso di un singolo tipo di GPU per ogni fase di un carico di lavoro, spostandosi invece verso architetture disaggregate e ottimizzate che suddividono pre-elaborazione, esecuzione dell'inferenza e post-elaborazione su silicio specializzato di diversi fornitori. AMD ha presentato Helios e la partnership con Cerebras come un'alternativa multi-vendor e basata su ecosistema aperto all'approccio verticalmente integrato di Nvidia .
Oltre alla partnership con Cerebras e al lancio di Helios, AMD ha fatto diversi altri annunci significativi:
AMD ha rivelato di aver concluso un accordo con un cliente, Anthropic, all'inizio della stessa settimana, prima dell'evento Advancing AI. Anthropic si è unito all'elenco dei grandi laboratori di AI che si sono impegnati a implementare l'hardware AMD (inclusi i sistemi Helios) su larga scala, come parte di una tendenza più ampia delle aziende AI di alto livello a diversificare dal monopolio delle GPU di Nvidia .
Cerebras ha avuto un anno importante, indipendentemente dalla partnership con AMD. L'azienda è stata quotata in borsa il 14 maggio 2026, sul Nasdaq con il ticker CBRS. Ha fissato il prezzo di 30 milioni di azioni a 185,00 dollari ciascuna, ben al di sopra della fascia inizialmente prevista di 115-125 dollari, raccogliendo 5,55 miliardi di dollari nella più grande IPO tech statunitense del 2026. Il titolo è balzato del 68% nel primo giorno di negoziazione, chiudendo a 311,07 dollari .
Nel gennaio 2026, OpenAI e Cerebras hanno annunciato un accordo pluriennale per un massimo di 750 megawatt di capacità di calcolo. L'impegno iniziale è stato riportato a circa 10 miliardi di dollari, poi ampliato a oltre 20 miliardi di dollari (con un potenziale tetto di 30 miliardi di dollari). È stato anche riferito che OpenAI ha ricevuto una partecipazione azionaria fino al 10% in Cerebras come parte dell'accordo .