為這些代理提供智慧的,則是 Nemotron 3 Ultra。這個具備 5500 億參數的開源模型,被 NVIDIA 稱為「美國企業所釋出過最強大的開源模型」。它位於 Nemotron 3 家族的頂端,位居先前已發表的 40 億參數 Nano 與 1200 億參數 Super 模型之上
。
根據 NVIDIA 的官方文件與白皮書,該模型採用混合 Mamba-Transformer 的混合專家架構(MoE)設計 。這樣的設計讓每個 Token 最多可啟用約 550 億個活躍參數,同時保持推論過程的運算效率
。NVIDIA 表示,這代表在面對複雜的代理工作流程時,它能比前代產品達到快上 5 倍的推論速度,以及最多降低 30% 的成本
。
至關重要的是,Nemotron 3 Ultra 擁有原生的 100 萬 Token 上下文視窗。根據 NVIDIA 開發者部落格的說法,這是針對橫跨龐大程式碼庫、多文件深度研究,以及長時間代理記憶等任務,維持連貫推理能力的關鍵,能避免因區塊分割策略所導致的典型脈絡碎片化問題 。此模型預計於 2026 年 6 月 4 日開放原始碼對外釋出
。
NVIDIA 以 DGX Station for Windows 的揭幕,完成了從晶片到軟體的完整堆疊。這款被譽為全球最強桌邊型 AI 超級電腦的系統,專為將尖端 AI 開發直接帶到企業桌上、並原生執行 Windows 而設計 。
DGX Station 搭載全新的 NVIDIA GB300 Grace Blackwell Ultra 桌上型超級晶片,透過高速的 NVLink-C2C 互連,將一顆 Blackwell Ultra GPU 與一顆 72 核心的 Grace CPU 相互結合,創造出一個高達 748 GB 的統一且一致化記憶體池 。最終成果是一套能提供高達 20 petaflops FP4 AI 運算效能的系統,可在地端完全運行高達 1 兆參數的前沿 AI 模型,或同時支援數百個平行運作的 AI 代理
。
此舉是一記直拳,旨在將企業 AI 的開發工作,從共享的雲端執行個體轉移到專用、且永遠在線的本地硬體上。NVIDIA 宣布,DGX Station for Windows 將於 2026 年第四季透過 OEM 系統製造商生態系統正式出貨 。
工程與電子設計自動化(EDA)軟體領導廠商是首批行動者。益華電腦(Cadence)、達梭系統(Dassault Systèmes)、西門子(Siemens) 與 新思科技(Synopsys) 宣布,計畫使用 NemoClaw 框架來建置自主 AI 工程師。這些數位同事被設計來執行複雜的模擬與驗證工作流程,NVIDIA 聲稱此舉能將數週的工程工作壓縮至數小時內完成 。
在硬體與平台方面,微軟(Microsoft) 正在合作,要為個人與企業代理提供能與 Windows 應用程式無縫接軌的原生 Windows 體驗 。系統製造商戴爾(Dell)、惠普(HP) 與華碩(ASUS) 都名列 DGX Station 桌邊型設備的 OEM 合作夥伴,確保這款超級電腦能透過標準的企業 IT 採購管道廣泛普及
。
藉由這些在 GTC 台北的布局,NVIDIA 已將自身定位為代理式 AI 時代中,不僅是零組件供應商,更是完整、開放且企業就緒之堆疊的總設計師——從模型權重,一路延伸到辦公室地板上那台工作站。