与编排层相辅相成的是OpenShell,一个安全的隔离运行时环境,它强制执行隐私控制,以便在任何专用平台上托管和执行代理,无论是RTX工作站、云虚拟机还是新的DGX Station 。NemoClaw和OpenShell共同为数字同事创建了一个沙盒式的操作环境,可以在不损害敏感数据的情况下无限期运行。
为这些智能体的“智力”提供燃料的是Nemotron 3 Ultra,一个拥有5500亿参数的开源模型,英伟达声称这是美国公司有史以来发布的最强大的开源模型 。它位于Nemotron 3家族的顶端,高于之前发布的40亿参数的Nano和1200亿参数的Super模型
。
根据英伟达官方的文件和白皮书,该模型使用了一种混合Mamba-Transformer的混合专家(MoE)架构 。这种设计使得每个token可以激活高达约550亿的参数,同时保持推理计算的高效性
。英伟达报告称,与之前代产品相比,这意味着在处理复杂的代理工作流时,推理速度提升了5倍,成本最多降低了30%
。
至关重要的是,Nemotron 3 Ultra拥有原生的100万token上下文窗口,英伟达开发者博客指出,这对于跨庞大代码库、深度多文档研究和长期运行的代理记忆进行持续的推理至关重要,可以避免因分块启发式方法带来的典型碎片化问题 。该模型定于2026年6月4日开放发布
。
随着DGX Station for Windows的发布,英伟达完成了从芯片到软件的完整堆栈。它被称为世界上最强大的桌面级AI超级计算机,该系统专为将前沿AI开发直接带到企业桌面上而设计,并可原生运行Windows系统 。
DGX Station由全新的NVIDIA GB300 Grace Blackwell Ultra桌面超级芯片驱动,通过高速NVLink-C2C互连,将Blackwell Ultra GPU与72核的Grace CPU配对,创建了一个高达748GB的统一、一致内存池 。其结果是,该系统可提供高达20千万亿次浮点运算(petaflops)的FP4 AI计算性能,并且可以在完全本地化环境下运行多达1万亿参数的前沿AI模型,或同时支持数百个并行的AI代理
。
此举旨在直接将企业AI开发从共享的云实例转移到专用的、永远在线的本地硬件上。英伟达宣布,DGX Station for Windows将于2026年第四季度通过一个由OEM系统构建商组成的生态系统上市 。
工程和EDA软件领导者是首批行动者。Cadence、达索系统、西门子和Synopsys宣布,计划使用NemoClaw框架来构建自主AI工程师。这些数字同事旨在执行复杂的仿真和验证工作流程,英伟达声称这可以将数周的工程工作压缩到数小时内完成 。
在硬件和平台方面,微软正在合作提供原生的Windows体验,使个人和企业代理能够无缝连接Windows应用程序 。系统构建商戴尔、惠普和华硕均被指定为DGX Station桌面形态的OEM合作伙伴,确保这款超级计算机能够通过标准的企业IT采购渠道广泛提供
。
通过在GTC台北的一系列动作,英伟达已将自己定位为AI代理时代的架构师,而不仅仅是组件供应商,提供了一个完整、开放且企业就绪的栈——从模型权重到办公室地板上的工作站。