Il punto non è soltanto vendere una nuova GPU: AMD sta cercando di proporre un’intera infrastruttura, composta da acceleratori, CPU, rete e software ROCm.
Ogni rack Helios integra:
La MI455X è l’acceleratore AI più avanzato presentato da AMD all’evento e costituisce il componente centrale di Helios . Il sistema è progettato per il raffreddamento a liquido e per l’esecuzione di modelli di frontiera su larga scala.
La CEO di AMD Lisa Su ha definito Helios «semplicemente il miglior rack AI al mondo» e «il rack AI dalle prestazioni più elevate del settore per addestrare ed eseguire modelli di frontiera su scala massiccia» . Si tratta, naturalmente, di una valutazione dell’azienda: i confronti indipendenti sulle prestazioni reali dipenderanno dai carichi di lavoro, dal software e dalla disponibilità dei sistemi.
AMD ha dichiarato che Helios è già in piena produzione e che le consegne entreranno nella stessa finestra di approvvigionamento dei rack Nvidia Vera Rubin NVL72 .
Il prezzo indicato è compreso tra 5 e 5,5 milioni di dollari per rack, pari a circa 5,25 milioni di dollari considerando il valore centrale dell’intervallo . Il dato riguarda quindi un sistema infrastrutturale destinato a data center e grandi operatori cloud, non una configurazione acquistabile sul normale mercato dei PC.
AMD ha inoltre lanciato commercialmente il processore server EPYC Venice, basato sull’architettura Zen 6. Secondo la società, è il primo processore x86 per server realizzato sulla tecnologia a 2 nanometri di TSMC .
Venice funge da CPU di supporto nei cassetti di calcolo Helios e può arrivare fino a 256 core Zen 6 . In questo modo AMD punta a controllare non solo la parte accelerata del calcolo AI, ma anche le componenti generali del sistema e la gestione dei dati.
Uno dei principali argomenti di AMD nel confronto con Nvidia riguarda la memoria ad alta larghezza di banda, essenziale quando si devono mantenere modelli molto grandi direttamente sugli acceleratori.
Ogni MI455X offre 288 GB di memoria HBM3E. Moltiplicata per 72 GPU, la capacità aggregata del rack arriva a circa 20,7 TB . AMD sostiene inoltre che Helios garantisca, rispetto ai sistemi concorrenti basati su Vera Rubin:
Questi numeri sono dichiarazioni di AMD e vanno interpretati come risultati rivendicati dall’azienda, non come un verdetto definitivo valido per ogni applicazione. La maggiore capacità di memoria può essere particolarmente utile nell’inferenza, cioè nella fase in cui un modello già addestrato risponde alle richieste degli utenti.
Il quadro resta però meno favorevole ad AMD nell’addestramento: gli analisti continuano a indicare Nvidia come leader in questo ambito e sottolineano la maggiore maturità del suo ecosistema software CUDA . AMD risponde con ROCm, una piattaforma open source in crescita, ma ancora meno diffusa rispetto a CUDA .
Durante il keynote sono stati indicati diversi clienti e collaboratori di rilievo :
| Azienda | Impegno o ruolo indicato |
|---|---|
| Microsoft Azure | Cliente di riferimento per Helios; le spedizioni dovrebbero iniziare nella seconda metà del 2026 |
| OpenAI | Fino a 6 gigawatt di infrastruttura AMD; i rack Helios sono già in uso |
| Meta | Insieme a OpenAI, fino a 12 gigawatt di capacità basata su acceleratori AMD |
| Oracle | Indicata tra i primi clienti Helios |
| Anthropic | Fino a 2 gigawatt di sistemi Helios |
| AT&T | Adozione o test di piattaforme AMD |
| Cisco | Adozione o test di piattaforme AMD |
| Cerebras | Collaboratore tecnologico e partner per l’inferenza AI |
Il riferimento ai gigawatt descrive la capacità energetica associata all’infrastruttura dei data center: non equivale al numero di GPU e non indica, da solo, la potenza di calcolo effettivamente disponibile.
L’annuncio più pesante sul piano finanziario è arrivato il 22 luglio, durante il primo giorno dell’evento . AMD ha impegnato un investimento azionario strategico in Anthropic fino a 5 miliardi di dollari . Anthropic è la società che sviluppa la famiglia di modelli Claude.
L’accordo prevede inoltre che Anthropic implementi fino a 2 gigawatt di GPU AMD Instinct della serie MI450, fornite attraverso sistemi rack-scale Helios . Il primo gigawatt dovrebbe essere installato nella prima metà del 2027 .
Tom Brown, cofondatore di Anthropic, ha citato la facilità d’integrazione e le prestazioni tra le ragioni della collaborazione. Le due aziende lavoreranno anche su sicurezza e protezione dei sistemi AI .
Il patto ha quindi una doppia natura: da un lato è un ordine potenziale di enorme portata per l’infrastruttura AMD; dall’altro è un investimento diretto nel laboratorio AI, con un possibile effetto sullo sviluppo dell’ecosistema software e hardware di AMD.
Il 23 luglio AMD ha annunciato anche una partnership tecnica con Cerebras per realizzare un’architettura di inferenza AI disaggregata .
In pratica, l’elaborazione non viene concentrata su un unico tipo di processore. Helios e il Wafer-Scale Engine di Cerebras opereranno all’interno di un singolo flusso di lavoro, combinando l’elevato throughput delle GPU Instinct con la generazione dei token a bassissima latenza tipica della piattaforma Cerebras .
I clienti potranno dividere le diverse fasi dell’inferenza tra i due sistemi. L’approccio è pensato per applicazioni complesse e sensibili ai tempi di risposta, come assistenti AI e agenti virtuali in tempo reale . La soluzione congiunta dovrebbe essere disponibile inizialmente attraverso Cerebras Cloud nella seconda metà del 2026 .
| Caratteristica | AMD Helios | Nvidia Vera Rubin NVL72 |
|---|---|---|
| Prezzo per rack | 5–5,5 milioni di dollari | Non comunicato ufficialmente |
| GPU per rack | 72 MI455X | 72 GPU Rubin |
| Memoria per GPU | 288 GB HBM3E | Circa 288 GB, secondo le stime disponibili |
| Memoria totale per rack | Circa 20,7 TB | Circa 20,7 TB di capacità grezza comparabile |
| Ampiezza di banda | Vantaggio dichiarato per la banda per GPU | Interconnessione NVLink più forte |
| Addestramento | Secondo agli occhi degli analisti | Leader |
| Software | ROCm, open source e in crescita | CUDA, maturo e dominante |
| Quota di mercato nel 2026 | Circa 5–7% | Circa 80% |
Il confronto non significa che AMD abbia già superato Nvidia. Nvidia conserva un vantaggio rilevante in quota di mercato, addestramento e software. Helios rappresenta però un cambio di scala per AMD: per la prima volta l’azienda propone un rack completo destinato a competere direttamente con la piattaforma più avanzata del principale rivale nello stesso ciclo di acquisto .
Le novità di Advancing AI 2026 rafforzano la strategia di AMD su tre fronti: sistemi completi, memoria e inferenza e partnership con i laboratori AI. Helios offre una proposta rack-scale con un prezzo dichiarato, clienti di riferimento e produzione già avviata. L’investimento fino a 5 miliardi di dollari in Anthropic aggiunge inoltre un importante voto di fiducia da parte di uno dei maggiori sviluppatori di modelli AI.
La sfida a Nvidia, tuttavia, è ancora aperta. Il vantaggio hardware rivendicato da AMD dovrà misurarsi con la capacità di consegnare sistemi su larga scala, far maturare ROCm e dimostrare prestazioni competitive nei carichi di addestramento e di inferenza più diversi.