Lo stesso giorno in cui è stata divulgata la notizia di Nemotron 4, Nvidia ha rilasciato due nuovi prodotti open-source pensati per lo strato degli agenti AI (i cosiddetti 'agenti autonomi') :
Nemotron 3.5 Lightning — Un modello con architettura mixture-of-experts (MoE) da 30 miliardi di parametri, che ne attiva solo 3 miliardi per ogni fase di inferenza, garantendo una velocità di output circa 4 volte superiore rispetto a modelli densi comparabili. È progettato per attività specializzate ad alto volume e può funzionare su una singola GPU . Kari Briski, VP di Nvidia, ha dichiarato che il modello "contiene la conoscenza di modelli più potenti" distillata in una forma leggera ed efficiente .
NeMo Switchyard — Una libreria open-source che assegna dinamicamente ogni fase di un flusso di lavoro di un agente al modello (open o proprietario) più adatto a quello specifico compito, senza richiedere la riscrittura delle applicazioni. I test interni di Nvidia mostrano che può ridurre i costi delle attività degli agenti a circa un terzo rispetto ai costi di base . Tra le implementazioni reali ci sono la piattaforma Devin di Cognition e altre piattaforme di agenti .
La strategia open-source di Nvidia ha uno scopo commerciale ben preciso: ampliare l'adozione dell'AI per alimentare la domanda di GPU. Rilasciando modelli open di alta qualità in modo gratuito, Nvidia abbassa le barriere per le aziende che vogliono creare applicazioni di AI, il che a sua volta aumenta la necessità dei suoi hardware . A marzo 2026, l'azienda ha anche lanciato la Nemotron Coalition, una collaborazione senza precedenti tra laboratori di AI come Mistral AI, Perplexity, Reflection AI e altri, con l'obiettivo di far progredire i modelli aperti di frontiera attraverso la condivisione di dati e potenza di calcolo .
L'ascesa di modelli open-source cinesi a basso costo e ad alte prestazioni — iniziata con lo shock di DeepSeek all'inizio del 2025 e proseguita con Kimi K3 di Moonshot AI (il più grande modello open-source mai rilasciato) — ha scosso le aziende tecnologiche statunitensi . Questi modelli offrono prestazioni vicine a quelle dei modelli di frontiera USA a una frazione del costo, mettendo sotto pressione i prezzi di tutto il settore . L'amministratore delegato di Nvidia, Jensen Huang, ha pubblicamente esortato Washington ad abbracciare i modelli aperti invece di bandirli, sostenendo che l'AI open-source non è un rischio per la sicurezza, ma un catalizzatore per una più ampia adozione e innovazione . Le stesse uscite di modelli open di Nvidia si sono accelerate in risposta diretta a questa ondata competitiva .
A fine luglio 2026, Nvidia ha iniziato silenziosamente a costituire un team dedicato all'ingegneria della sicurezza AI, come rivelato da una serie di annunci di lavoro aziendali . Il team sta assumendo figure senior tra cui un lead tecnico fondatore (distinguished engineer), ingegneri per la ricerca sulla sicurezza, ingegneri di valutazione e senior manager . La sua missione è affrontare le vulnerabilità degli agenti AI autonomi e dei modelli a pesi aperti, sviluppare software di sicurezza basato sull'AI e condurre valutazioni di sicurezza prima che i modelli vengano ampiamente distribuiti .
Questo team interno è separato ma complementare alla Open Secure AI Alliance, una coalizione più ampia lanciata da Nvidia a luglio 2026 con Microsoft, SpaceX, Dell e altri per sviluppare strumenti di sicurezza e cybersecurity open-source per l'AI — formata pochi giorni dopo un attacco informatico di alto profilo che ha coinvolto modelli OpenAI 'ribelli' .