Nemotron 3 Ultra 位居一個共享相同混合 Mamba-Transformer MoE 架構的三款模型家族之首 。
| 模型 | 總參數 | 每個 Token 啟動參數 | 重點特色 |
|---|---|---|---|
| Nemotron 3 Nano | ~40 億 | 最小 | 針對 RTX PC 和 DGX Spark 上的本地及邊緣推論進行優化 |
| Nemotron 3 Super | 1200 億 | 120 億 | 2026 年 3 月 11 日發布;在 PinchBench 上獲得 85.6% 的成績,是代理任務表現最佳的開放模型 |
| Nemotron 3 Ultra | 5500 億 | 550 億 | 規模最大;發表時為美國智慧評分最高的開放權重模型 |
此三款模型皆支援高達 100 萬 Token 的上下文窗口。Super 和 Ultra 版本則包含了 NVFP4 訓練、LatentMoE 和多 Token 預測層 。
NemoClaw 和 OpenShell 首次於 2026 年 3 月的 GTC 大會上亮相,並在 Computex 上再次被提及,它們構成了 Nvidia 的企業級 AI 代理堆疊 。
Nvidia Vera CPU 是一款專為在資料中心指揮 AI 工作負載而設計的客製化 Arm 架構處理器 。
Vera CPU 在 Vera Rubin NVL72 機架規模系統中擔任主處理器,與次世代 GPU 協同工作,為 AI 工廠提供動力 。
RTX Spark 是 Nvidia 首款面向消費級 Windows PC 的專用系統單晶片(SoC),與聯發科技共同開發,採用台積電 3 奈米製程 。黃仁勳形容它如同「將我們 33 年來所學的一切濃縮於一顆晶片中」 。
Nvidia 將 RTX Spark 定位為「全球首款專為個人 AI 代理設計的 Windows PC」 。
Nvidia 確認 Vera Rubin 平台已進入全面量產階段,系統預計將於 2026 年下半年送達合作夥伴手中 。
在 Computex 的主題演講中,Nvidia 將 Vera Rubin 描述為新一代 AI 工廠的基石 。
總體而言,Computex 2026 是 Nvidia 垂直整合策略迄今最清晰的展示:
黃仁勳在主題演講中傳達的訊息單純而明確:Nvidia 現在供應 AI 堆疊中的每一個環節,從矽晶片、開放模型、代理程式執行環境,到工廠規模的部署基礎設施,一應俱全。