对于Rubin能否支撑前沿模型研发,OpenAI是最具代表性的真实场景之一。顶尖AI实验室通常对训练容量、互连性能、系统可靠性,以及基础设施快速扩容能力提出极高要求。
如果OpenAI的部署顺利投入运行,至少能在三个方面提供证据:
不过,部署公告本身并不能说明已安装多少个机架、训练取得了怎样的结果,也不能确定相关收入何时确认。这些细节最终决定了该事件是一次具有商业转折意义的里程碑,还是一次较早期的技术验证。
现有报道中没有英伟达公布的官方目录价格。不同机构根据配置和时间给出的估算并不一致:
资本开支还远不止购买机架。Investing.com援引伯恩斯坦估算称,建设1吉瓦Vera Rubin数据中心容量的成本约为470亿美元。这是基础设施成本估算,并非英伟达收入的直接预测,也不是适用于所有项目的统一建设成本。
这并不意味着每个Rubin部署项目都会更赚钱。CoreWeave的利润率仍取决于合同价格、利用率、融资成本、电力、散热、运营费用以及具体硬件配置。但这一信息至少挑战了一个简单判断:新一代AI系统因为需要更高资本投入,就必然会压低云服务商利润。
真正的关键在于,性能提升和客户定价能否抵消更高的前期投资。如果客户愿意为更快或更高效的AI算力付费,同时云服务商又能保持较高利用率,那么机架级系统即使购买成本更高,也可能带来更好的经营回报。
这一区别非常关键。让单块芯片通电运行,并不等同于运营一套完整的液冷机架;后者还必须确保网络连接和软件栈协同工作。CoreWeave的工作提供了一个早期证据,表明Rubin能够在生产级规模运行,也为后续客户部署降低了系统集成风险。
CoreWeave还公布了一项基于真实硬件的对比结果:在匹配的DeepSeek-R1工作负载下,Vera Rubin NVL72每兆瓦每秒生成的Token数量,是英伟达GB200 NVL72的10倍。需要注意的是,这是公司在特定条件下报告的基准结果,并不代表所有工作负载都能获得同样表现。
这一规模之所以重要,是因为行业瓶颈已经不只是“能否生产足够多的GPU”。一套可运行的AI机架还需要GPU、CPU、先进内存、服务器、网络设备、液冷硬件、电力基础设施和安装能力同步到位。
英伟达如果进一步负责协调、甚至直接交付这些完整系统,可能加深其对AI基础设施栈的控制,并获取更多系统价值。但与此同时,执行风险也会增加:任何一个关键部件延迟,都可能拖慢整套机架的交付;机架交付延迟,又可能影响客户数据中心的上线计划和英伟达的收入确认时间。
如果未来采用相同的72-GPU基本单元,那么双机架、四机架和八机架配置将分别包含144块、288块和576块GPU。这些数量是简单的规模换算;现有资料并未独立确认这三种配置均已成为正式产品SKU,或已经有明确交付时间表。其核心意义在于,英伟达正在围绕可重复组合的机架级单元,搭建能够扩展到更大规模的“AI工厂”。
8月26日的财报不应只被视为一份回顾性业绩报告,更应被看作Rubin商业化进度的一次检验。投资者可以重点关注四个问题:
910亿美元的当期业绩固然重要,但更值得关注的可能是下一季度展望,以及管理层对客户承诺的描述。一个有说服力的Rubin增长故事,需要可重复的客户需求,而不是仅仅一次成功的首批部署。
OpenAI部署Vera Rubin的意义,在于它把英伟达的下一代平台与前沿AI开发中最苛刻的训练和推理任务联系起来。CoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructure和Nebius等平台已经运行Rubin,也进一步表明这套架构正在从产品公告走向实际部署。
但投资逻辑仍取决于执行结果。机架价格只是行业和投行估算,并非官方售价;CoreWeave报告的利润率改善具有公司自身特点;早期系统验证也不能证明英伟达已经实现大规模交付。
英伟达8月26日的财报,将帮助市场判断:Vera Rubin究竟正在成为一个可规模化、可盈利的系统业务,还是仍处于令人印象深刻、但尚未完全完成的基础设施转型阶段。