AWS prevede di distribuire 2 milioni di GPU NVIDIA aggiuntive nella propria infrastruttura globale tra il 2027 e il 2028, dopo il piano per oltre 1 milione di GPU a partire dal 2026. La flotta includerà le piattaforme NVIDIA Blackwell Ultra, Rubin e Rubin Ultra, insieme a CPU Vera, reti ad alta velocità e sistemi ra...
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Amazon Web Services and NVIDIA announce on August 27, 2026, regarding AWS’s planned deployment of 2 million additional NVIDIA GPUs. Article summary: AWS and NVIDIA announced a major expansion of their AI-infrastructure partnership: AWS plans to deploy 2 million additional NVIDIA GPUs globally in 2027–28, on top of more than 1 million NVIDIA GPUs it had already planne. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
AWS e NVIDIA stanno ampliando la loro collaborazione sull’infrastruttura per l’intelligenza artificiale. Il piano prevede che AWS distribuisca 2 milioni di GPU NVIDIA aggiuntive nella propria infrastruttura globale tra il 2027 e il 2028. L’annuncio arriva pochi mesi dopo il precedente progetto di AWS, che prevedeva l’aggiunta di oltre 1 milione di GPU NVIDIA a partire dal 2026, mentre la domanda di capacità per addestramento e inferenza continua a crescere. 369
Il dato più vistoso è il numero di GPU, ma l’accordo va oltre la semplice fornitura di acceleratori. Le due aziende descrivono una strategia infrastrutturale pluriennale che comprende GPU di più generazioni, CPU, networking, modelli aperti, elaborazione dei dati, robotica, AI factory e carichi di lavoro governativi sicuri.
Le GPU previste includeranno le piattaforme Blackwell Ultra, Rubin e Rubin Ultra. Si tratta quindi di un impegno orientato a più generazioni di hardware NVIDIA, non di un ordine concentrato su una sola famiglia di acceleratori. 168
AWS e NVIDIA non hanno comunicato il valore economico dell’accordo. Il numero di 2 milioni va dunque interpretato come un obiettivo di distribuzione nella rete infrastrutturale di AWS, non come una quantità già installata o immediatamente disponibile per i clienti. 14
La rapidità dell’espansione offre anche un’indicazione sulla pressione esercitata dalla domanda di calcolo per l’IA. L’annuncio è arrivato solo pochi mesi dopo il piano per oltre 1 milione di GPU a partire dal 2026; secondo le ricostruzioni disponibili, le richieste dei clienti avrebbero superato le aspettative iniziali. 39
La collaborazione comprende sistemi basati sulle CPU NVIDIA Vera, networking, modelli aperti, elaborazione dei dati, robotica e AI factory. 16
Per i grandi progetti di IA, infatti, la GPU è soltanto uno degli elementi necessari. Le CPU coordinano i carichi di lavoro, le reti ad alta velocità collegano i processori e i sistemi di storage e data processing gestiscono il flusso di informazioni durante l’addestramento e l’inferenza.
AWS e NVIDIA stanno quindi cercando di presentare un’infrastruttura integrata, anziché un semplice catalogo di istanze cloud dotate di GPU. L’obiettivo è sostenere carichi come l’IA agentica, in cui i software eseguono attività articolate in più passaggi, e l’IA fisica, che comprende applicazioni legate alla robotica. 68
L’introduzione di infrastrutture basate sulle CPU NVIDIA Vera amplia il ruolo di NVIDIA all’interno dei sistemi AWS destinati all’IA agentica. Vera viene proposta insieme alle GPU e alle tecnologie di networking dell’azienda, come parte di uno stack infrastrutturale più ampio. 1011
Per i clienti, questo potrebbe tradursi in future istanze progettate come sistemi CPU-GPU completi, invece che come configurazioni in cui la GPU viene considerata un componente isolato. Un’impostazione di questo tipo può essere utile per applicazioni che richiedono molta orchestrazione, un intenso trasferimento di dati e l’interazione tra modelli, strumenti esterni e agenti software.
L’espansione della collaborazione non significa che AWS stia abbandonando i propri chip per l’IA. L’azienda continua a sviluppare e offrire Trainium, mentre rafforza contemporaneamente il rapporto con NVIDIA. Le due società hanno indicato l’estensione di NVLink Fusion e il lavoro su memoria NVIDIA personalizzata ad alta larghezza di banda per sistemi basati su Trainium. 1113
La direzione sembra dunque essere quella della coesistenza. AWS può offrire infrastrutture basate su NVIDIA ai clienti che cercano l’ecosistema software e hardware dell’azienda, continuando allo stesso tempo a sviluppare Trainium per i carichi ottimizzati sui chip proprietari.
Per i clienti, questa impostazione potrebbe significare più possibilità di scelta nel bilanciare prestazioni, compatibilità software, disponibilità e costi infrastrutturali. Gli annunci disponibili chiariscono la strategia generale, ma non forniscono ancora dati sufficienti per confrontare l’economia o le prestazioni di ogni configurazione futura.
AWS e NVIDIA hanno inoltre descritto infrastrutture di tipo AI factory destinate a carichi di lavoro governativi e legati alla sicurezza nazionale degli Stati Uniti. Le ricostruzioni dell’annuncio indicano che queste implementazioni puntano a casi d’uso federali sicuri, oltre che all’infrastruttura commerciale per l’IA. 810
Questa componente amplia il mercato di riferimento della partnership: non ci sono soltanto aziende che sviluppano applicazioni consumer o software enterprise, ma anche organizzazioni per cui sicurezza, controllo degli accessi e requisiti di implementazione sono aspetti essenziali.
Le informazioni disponibili non descrivono tutti i dettagli tecnici o le eventuali certificazioni di questi ambienti. Per questo, l’annuncio va letto come una dichiarazione di direzione strategica, non come una descrizione completa dello stato finale delle infrastrutture governative.
La logica industriale dell’accordo è chiara: NVIDIA ottiene un grande canale cloud per distribuire più generazioni delle proprie piattaforme IA, mentre AWS aumenta la capacità disponibile e amplia l’offerta di sistemi integrati con tecnologia NVIDIA. 26
L’accordo consente inoltre ad AWS di proporsi come fornitore flessibile di infrastruttura per l’IA. I clienti potranno utilizzare sistemi ottimizzati per NVIDIA, sistemi basati su Trainium o configurazioni che collegano componenti dei due ecosistemi.
Questa flessibilità potrebbe diventare più importante con l’evoluzione dei carichi di lavoro: dalla formazione dei modelli più grandi si passa infatti sempre più all’inferenza in produzione, agli agenti autonomi, all’elaborazione dei dati e alla robotica.
Resta però una distinzione fondamentale: l’annuncio riguarda un piano, non la prova che tutte le 2 milioni di GPU saranno operative entro la fine del 2028. La realizzazione dipenderà dalla produzione dell’hardware, dalla costruzione dei data center, dalla disponibilità di energia e reti e dalla domanda dei clienti. Le fonti confermano la scala e l’ambito previsti, ma non specificano la distribuzione per area geografica, prodotto o singolo servizio AWS.
AWS e NVIDIA hanno annunciato l’intenzione di distribuire 2 milioni di GPU NVIDIA aggiuntive nel 2027 e nel 2028, oltre al precedente piano di AWS per più di 1 milione di GPU a partire dal 2026. L’espansione comprende Blackwell Ultra, Rubin e Rubin Ultra, ma anche CPU Vera, networking, AI factory, elaborazione dei dati e infrastrutture per la robotica. 136
Il messaggio più ampio è che la competizione nel cloud per l’IA si sta spostando verso sistemi completi, progettati a livello di rack e data center. AWS combina la piattaforma NVIDIA con la propria roadmap Trainium, mentre NVIDIA consolida la presenza nei diversi strati infrastrutturali necessari per portare l’IA agentica e fisica su scala globale.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
AWS prevede di distribuire 2 milioni di GPU NVIDIA aggiuntive nella propria infrastruttura globale tra il 2027 e il 2028, dopo il piano per oltre 1 milione di GPU a partire dal 2026.
AWS prevede di distribuire 2 milioni di GPU NVIDIA aggiuntive nella propria infrastruttura globale tra il 2027 e il 2028, dopo il piano per oltre 1 milione di GPU a partire dal 2026. La flotta includerà le piattaforme NVIDIA Blackwell Ultra, Rubin e Rubin Ultra, insieme a CPU Vera, reti ad alta velocità e sistemi rack scale per l’IA agentica e fisica.
AWS presenta l’hardware NVIDIA come complementare ai propri acceleratori Trainium, con l’obiettivo di offrire ai clienti più opzioni tra ecosistemi, prestazioni, compatibilità software e costi.