喺 Nemotron 4 消息傳出嘅同一日,Nvidia 推出咗兩個新嘅開源產品,主打代理式AI層 :
Nemotron 3.5 Lightning — 一個300億參數嘅混合專家(MoE)模型,每次推理步驟只激活 30億個參數,輸出速度比同類密集模型快大約 4倍。專為高用量、專門嘅代理任務而設,可以喺一張GPU上運行 。Nvidia 副總裁 Kari Briski 話呢個模型「包含咗更強大模型嘅知識」,濃縮成輕巧、高效嘅形式 。
NeMo Switchyard — 一個開源路由庫,可以動態分配代理工作流程嘅每一步畀最適合嗰個任務嘅模型(無論係開源定專屬),唔使重新寫應用程式。Nvidia 自己嘅測試顯示,可以 將代理任務成本降至原本大約三分之一 。實際應用包括 Cognition 嘅 Devin 同其他代理平台 。
Nvidia 嘅開源策略背後有一個核心商業目的:擴大AI應用,帶動GPU需求。透過免費推出高質素嘅開源模型,Nvidia 降低咗企業建立AI應用嘅門檻,進而增加對 Nvidia 硬件嘅需求 。公司仲喺2026年3月啟動咗 Nemotron Coalition,係首個由 Mistral AI、Perplexity、Reflection AI 等多間AI實驗室組成嘅合作計劃,共享數據同算力,推進開放前沿模型 。
低成本、高效能嘅中國開源模型崛起——由 DeepSeek 喺2025年初震驚業界開始,到 Moonshot AI 嘅 Kimi K3(史上最大嘅開源模型)——令美國科技公司非常頭痛 。呢啲模型嘅表現接近美國前沿模型,但成本只係一個零頭,挑戰晒成個行業嘅定價能力 。Nvidia CEO 黃仁勳公開呼籲華盛頓 擁抱開源模型而非封殺,話開源AI唔係安全風險,反而係推動更廣泛應用同創新嘅催化劑 。Nvidia 自己嘅開源模型推出速度都因為呢股競爭浪潮而加快 。
2026年7月底,Nvidia 開始靜靜地組建一個 專責AI安全同保安工程嘅團隊,從一系列招聘廣告可以睇到 。團隊正招聘多個高級職位,包括創始技術主管(傑出工程師)、保安研究工程師、評估工程師同高級經理 。任務係處理 自主AI代理同開源權重模型 嘅漏洞、開發由AI驅動嘅保安軟件,以及喺模型廣泛部署前進行安全評估 。
呢個內部團隊同 Open Secure AI Alliance 係相輔相成嘅關係。呢個聯盟係 Nvidia 喺2026年7月同 Microsoft、SpaceX、Dell 等公司一齊成立嘅,目的係開發開源AI安全同網絡安全工具——成立時間正正係一次涉及失控 OpenAI 模型嘅高調網絡攻擊之後 。