Nemotron 3 Ultra 是一个三模型家族的旗舰,它们共享相同的混合 Mamba-Transformer MoE 架构 。
| 模型 | 总参数量 | 每个 Token 激活量 | 亮点 |
|---|---|---|---|
| Nemotron 3 Nano | 约 40 亿 | 最小 | 专为在 RTX PC 和 DGX Spark 上进行本地及边缘推理优化 |
| Nemotron 3 Super | 1200 亿 | 120 亿 | 于 2026 年 3 月 11 日发布;在代理式任务评测 PinchBench 上获得 85.6%,是同级别最顶尖的开放模型 |
| Nemotron 3 Ultra | 5500 亿 | 550 亿 | 最大的模型;发布时美国开放权重模型智力评分最高 |
这三款模型均支持高达 100 万 token 的上下文窗口。其中,Super 和 Ultra 版本还包含了先进的 NVFP4 训练、LatentMoE 以及多 Token 预测层 。
这套面向企业的安全代理栈,最早在今年 3 月的 GTC 2026 上推出,此次在 Computex 上得到了再次强调 。
英伟达 Vera CPU 是一款为数据中心 AI 工作负载编排而生的定制 Arm 处理器 。
Vera CPU 作为主机处理器,被集成在 Vera Rubin NVL72 机架级系统中,与下一代 GPU 协同工作,共同构成 AI 工厂的核心动力 。
RTX Spark 是英伟达首款面向消费级 Windows PC 的专用系统级芯片(SoC),与联发科共同开发,采用台积电 3nm 工艺 。黄仁勋称其是“浓缩了我们 33 年来所学的一切” 。
英伟达将 RTX Spark 定位为“世界上第一款专为个人 AI 代理而生的 Windows PC 芯片” 。
英伟达确认,Vera Rubin 平台已进入全面量产阶段,合作厂商的系统预计将在 2026 年下半年 到位 。
在 Computex 的舞台上,英伟达毫不掩饰地宣告,Vera Rubin 将是下一代 AI 工厂的基石 。
总结来看,Computex 2026 是英伟达“垂直整合”战略最清晰的一次实力展示:
黄仁勋主题演讲的核心信息只有一个:今天,从芯片到开放模型,从代理运行时环境到工厂级的部署设施,英伟达已经能够为你提供 AI 世界中所需的每一层。