就在Nemotron 4消息公布的同一天,英伟达还发布了两款面向智能体AI层的开源产品:
Nemotron 3.5 Lightning—— 一个300亿参数的混合专家(MoE)模型,每次推理步骤仅激活30亿参数,其输出速度是同类密集型模型的约4倍。它专为高容量、特定任务的智能体场景设计,甚至可以运行在单块GPU上。英伟达副总裁Kari Briski称,这个模型“包含了更强大模型的知识”,并且被提炼成一种轻量、高效的形式。
NeMo Switchyard—— 一个开源的模型路由库,能够动态地将智能体工作流中的每一步分配给最适合该任务的模型(无论是开源还是闭源模型),且无需重写应用程序。英伟达的内部测试显示,它可以将智能体任务成本降低约三分之二。该工具已在Cognition的Devin以及其他智能体平台上得到实际部署。
英伟达的开源策略服务于一个核心商业目的:扩大AI的采用,从而推动GPU需求。通过免费发布高质量的开放模型,英伟达降低了企业构建AI应用的门槛,这反过来又增加了对英伟达硬件的需求。此外,英伟达早在2026年3月就成立了Nemotron联盟,这是一个由Mistral AI、Perplexity、Reflection AI等AI实验室组成的首创性合作组织,旨在通过共享数据和算力来推动前沿开源模型的发展。
低成本、高性能的中国开源模型的崛起,是驱动英伟达这一系列动作的关键外部因素。2025年初,DeepSeek的突然发布震惊全球,随后是Moonshot AI发布了史上最大的开源模型Kimi K3,这些模型极大地震动了美国科技公司。这些模型在性能上接近美国的前沿模型,但成本却低得多,对整个行业的定价权构成了挑战。英伟达CEO黄仁勋(Jensen Huang)已经公开呼吁华盛顿**“拥抱而非禁止”开源模型**,并辩称开源AI并非安全威胁,而是推动更广泛采用和创新的催化剂。英伟达自身的开源模型发布节奏也明显加快,以直接应对这股竞争浪潮。
2026年7月底,英伟达悄然开始组建一个专门的AI安全和安全工程团队。一系列企业招聘信息揭示了这一动向。该团队正在招募高级职位,包括创始技术负责人(杰出工程师)、安全研究工程师、评估工程师和高级经理。其使命是解决自主AI智能体和开源权重模型中的安全漏洞,开发由AI驱动的安全软件,并在模型广泛部署之前进行安全评估。
这个内部团队独立于更广泛的开放安全AI联盟,但又与其相辅相成。后者是英伟达在2026年7月与微软、SpaceX、戴尔等公司共同发起的一个联盟,旨在为AI开发开源的安全和网络安全工具——该联盟是在一次涉及失控OpenAI模型的高调网络攻击事件发生数天后成立的。