NVIDIA是唯一一个在这两项新基准上都提交了成绩的平台。 他们使用GB300 NVL72系统,通过定制的软件堆栈、CUDA图(CUDA Graphs)和先进的MoE路由策略,树立了全新的性能标杆 。
云服务提供商CoreWeave在本轮测试中打出了最响亮的一枪。
本轮测试清晰展示了NVIDIA最新的Blackwell Ultra平台(GB300 NVL72)相较于上一代Blackwell(GB200 NVL72)的巨大进步。
本轮MLPerf Training v6.0不仅见证了性能的飞跃,也反映了整个行业的蓬勃发展。
要驯服拥有6710亿参数的DeepSeek-V3这类MoE巨兽,单靠强大的GPU是不够的,卓越的网络和系统级设计至关重要。
MLPerf Training v6.0的结果有力地证明,在AI训练这个领域,极致的系统设计与软硬件协同优化,正成为推动大模型技术民主化和应用落地的核心引擎。