All'evento Advancing AI 2026 di AMD, tenutosi il 23 luglio a San Francisco, AMD e Cerebras hanno annunciato una partnership tecnica per costruire una piattaforma di inferenza AI disaggregata che abbina l'infrastruttur... L'architettura utilizza una suddivisione ottimizzata dei carichi di lavoro: le CPU EPYC di AMD g...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did AMD and Cerebras announce at AMD's Advancing AI 2026 event regarding a joint AI inferenc. Article summary: Here is a comprehensive, sourced breakdown of what was announced at AMD's Advancing AI 2026 event on July 23, 2026 in San Francisco.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it usefu
All'evento Advancing AI 2026 di AMD, tenutosi il 23 luglio 2026 a San Francisco, AMD e Cerebras hanno annunciato una partnership tecnica per sviluppare una nuova piattaforma di inferenza per l'intelligenza artificiale. Invece di affidarsi a un'unica architettura GPU per l'intero processo di inferenza, la soluzione congiunta abbina il sistema rack Helios di AMD, appena lanciato, al Wafer-Scale Engine (WSE) di Cerebras in un design disaggregato ottimizzato per il carico di lavoro .
La piattaforma utilizza un approccio a livelli per l'inferenza. Le CPU EPYC e le GPU Instinct di AMD (all'interno dei rack Helios) gestiscono le fasi iniziali: pre-elaborazione delle richieste, tokenizzazione e gestione di finestre di contesto ampie. Il WSE di Cerebras subentra poi per la fase più intensiva dal punto di vista computazionale: la generazione veloce di token, che richiede un'enorme larghezza di banda di memoria e throughput parallelo .
Questo design disaggregato consente a ogni sotto-attività di inferenza di essere eseguita sul silicio più adatto. AMD fornisce la logica CPU/GPU a bassa latenza per le fasi generiche, mentre il chip wafer-scale di Cerebras offre la potenza di calcolo parallela massiccia per l'esecuzione del modello principale . L'amministratore delegato di AMD, Lisa Su, ha descritto la partnership come parte di un cambiamento più ampio verso l'utilizzo di chip diversi per diverse fasi della pipeline di inferenza
.
Le aziende affermano che la piattaforma congiunta offre tempi di risposta significativamente inferiori per applicazioni AI complesse rispetto all'inferenza basata su GPU monolitiche. Il linguaggio ufficiale la descrive come in grado di fornire "inferenza AI a latenza ultra-bassa e throughput elevato leader del settore" . Non sono stati pubblicati numeri di benchmark specifici, come token al secondo o latenza in millisecondi, in dettaglio durante l'evento. Il titolo di Cerebras è salito di circa il 6% il giorno dell'annuncio
.
Si prevede che l'offerta congiunta sarà disponibile tramite Cerebras Cloud entro la fine del 2026. Cerebras prevede di implementare i sistemi AMD Helios nei propri data center per ospitare il servizio .
AMD ha anche lanciato ufficialmente Helios, il suo primo sistema AI su scala rack, all'evento. L'Amministratore Delegato Lisa Su lo ha definito "il rack AI più potente del mondo" e ne ha confermato la piena produzione . Le specifiche principali includono:
Helios si posiziona come concorrente diretto dei sistemi rack DGX e HGX di Nvidia, con AMD che rivendica prestazioni superiori sia nei carichi di lavoro di training che di inferenza AI .
Il messaggio principale dell'evento Advancing AI 2026 è stato che il mercato dell'inferenza AI si sta allontanando dall'uso di un singolo tipo di GPU per ogni fase di un carico di lavoro, spostandosi invece verso architetture disaggregate e ottimizzate che suddividono pre-elaborazione, esecuzione dell'inferenza e post-elaborazione su silicio specializzato di diversi fornitori. AMD ha presentato Helios e la partnership con Cerebras come un'alternativa multi-vendor e basata su ecosistema aperto all'approccio verticalmente integrato di Nvidia .
Oltre alla partnership con Cerebras e al lancio di Helios, AMD ha fatto diversi altri annunci significativi:
AMD ha rivelato di aver concluso un accordo con un cliente, Anthropic, all'inizio della stessa settimana, prima dell'evento Advancing AI. Anthropic si è unito all'elenco dei grandi laboratori di AI che si sono impegnati a implementare l'hardware AMD (inclusi i sistemi Helios) su larga scala, come parte di una tendenza più ampia delle aziende AI di alto livello a diversificare dal monopolio delle GPU di Nvidia .
Cerebras ha avuto un anno importante, indipendentemente dalla partnership con AMD. L'azienda è stata quotata in borsa il 14 maggio 2026, sul Nasdaq con il ticker CBRS. Ha fissato il prezzo di 30 milioni di azioni a 185,00 dollari ciascuna, ben al di sopra della fascia inizialmente prevista di 115-125 dollari, raccogliendo 5,55 miliardi di dollari nella più grande IPO tech statunitense del 2026. Il titolo è balzato del 68% nel primo giorno di negoziazione, chiudendo a 311,07 dollari .
Nel gennaio 2026, OpenAI e Cerebras hanno annunciato un accordo pluriennale per un massimo di 750 megawatt di capacità di calcolo. L'impegno iniziale è stato riportato a circa 10 miliardi di dollari, poi ampliato a oltre 20 miliardi di dollari (con un potenziale tetto di 30 miliardi di dollari). È stato anche riferito che OpenAI ha ricevuto una partecipazione azionaria fino al 10% in Cerebras come parte dell'accordo .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
All'evento Advancing AI 2026 di AMD, tenutosi il 23 luglio a San Francisco, AMD e Cerebras hanno annunciato una partnership tecnica per costruire una piattaforma di inferenza AI disaggregata che abbina l'infrastruttur...
All'evento Advancing AI 2026 di AMD, tenutosi il 23 luglio a San Francisco, AMD e Cerebras hanno annunciato una partnership tecnica per costruire una piattaforma di inferenza AI disaggregata che abbina l'infrastruttur... L'architettura utilizza una suddivisione ottimizzata dei carichi di lavoro: le CPU EPYC di AMD gestiscono la pre elaborazione delle richieste e le finestre di contesto ampie, mentre il WSE di Cerebras accelera la gene...