Samma dag som nyheten om Nemotron 4 briserade, släppte Nvidia två nya open source-produkter som riktar sig till agentisk AI :
Nemotron 3.5 Lightning – En modell med 30 miljarder parametrar och mixture-of-experts (MoE)-arkitektur som bara aktiverar 3 miljarder parametrar per inferenssteg, vilket ger ungefär 4 gånger snabbare utdata än jämförbara täta modeller. Den är designad för högvolym, specialiserade agentuppgifter och kan köras på ett enda GPU-kort . Nvidias VP Kari Briski sade att modellen "innehåller kunskapen från mer kraftfulla modeller" destillerad till en lättviktig och effektiv form .
NeMo Switchyard – Ett open source-routningsbibliotek som dynamiskt tilldelar varje steg i ett agentarbetsflöde till den modell (öppen eller proprietär) som bäst passar uppgiften, utan att applikationen behöver skrivas om. Nvidias egna tester visar att det kan minska kostnaderna för agentuppgifter till ungefär en tredjedel av baslinjen . Verkliga användningsområden inkluderar Cognitions Devin och andra agentiska plattformar .
Nvidias open source-strategi tjänar ett centralt affärssyfte: bredda AI-användningen för att driva efterfrågan på GPU:er. Genom att släppa gratis, högkvalitativa öppna modeller sänker Nvidia tröskeln för företag att bygga AI-applikationer, vilket i sin tur ökar behovet av Nvidias hårdvara . Företaget har också lanserat Nemotron Coalition (mars 2026), ett unikt samarbete mellan AI-labb som Mistral AI, Perplexity, Reflection AI och andra, för att främja öppna frontmodeller genom delad data och beräkningskraft .
Framväxten av billiga, högpresterande kinesiska open source-modeller – ledda av DeepSeeks chockartade lansering i början av 2025 och följt av Moonshot AI:s Kimi K3 (den största open source-modellen som någonsin släppts) – har skakat om amerikanska teknikföretag . Dessa modeller presterar nära de främsta amerikanska modellerna till en bråkdel av kostnaden, vilket utmanar prisnivåerna i hela branschen . Nvidias vd Jensen Huang har offentligt uppmanat Washington att omfamna öppna modeller snarare än att förbjuda dem, och argumenterat för att open source-AI inte är en säkerhetsrisk utan en katalysator för bredare användning och innovation . Nvidias egna lanseringar av öppna modeller har accelererat som ett direkt svar på denna konkurrensvåg .
I slutet av juli 2026 började Nvidia tyst att samla ett dedikerat AI-säkerhets- och säkerhetsteknikteam, vilket avslöjades genom en serie företagsannonser . Teamet rekryterar seniora roller som en grundande teknisk ledare (distinguished engineer), säkerhetsforskningsingenjörer, utvärderingsingenjörer och seniora chefer . Dess uppdrag är att hantera sårbarheter i autonoma AI-agenter och modeller med öppna vikter, utveckla AI-drivna säkerhetsprogram och genomföra säkerhetsutvärderingar innan modeller används i stor skala .
Detta interna team är separat från men kompletterar Open Secure AI Alliance, en bredare koalition som Nvidia lanserade i juli 2026 tillsammans med Microsoft, SpaceX, Dell och andra för att utveckla open source-säkerhets- och cybersäkerhetsverktyg för AI – bildad dagar efter en uppmärksammad cyberattack som involverade okontrollerade OpenAI-modeller .