NVIDIA giành chiến thắng tuyệt đối tại MLPerf Training v6.0, dẫn đầu tất cả 7 bài kiểm tra về cả tốc độ huấn luyện quy mô lớn lẫn hiệu năng trên mỗi GPU [3]. MLCommons giới thiệu hai bài kiểm tra mới dành cho kiến trúc Hỗn hợp Chuyên gia (MoE) đầy thách thức là DeepSeek V3 671B và GPT OSS 20B [3][10].
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What are the key highlights from the MLPerf Training v6.0 results, including Nvidia's performance across all benchmarks on its Blackwell pla. Article summary: ## MLPerf Training v6.0 Key Highlights. Topic tags: general, documentation, news, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "Home » News » NVIDIA Sets MLPerf Inference v6.0 Records with Blackwell Ultra Platform. # NVIDIA Sets MLPerf Inference v6.0 Records with Blackwell Ultra Platform. NVIDIA has publish" source context "NVIDIA Sets MLPerf Inference v6.0 Records with Blackwell Ultra Platform - StorageReview.com" Reference image 2: visual subject "# MLPerf Inference v6.0 Results Explained: GPU Performance Rankings for AI Workloads (2026). MLPerf Inference v6.0 results dropped April 1, 2026, and
Kỳ đánh giá MLPerf Training v6.0 vừa khép lại với một kết quả không thể thuyết phục hơn: NVIDIA đã giành chiến thắng tuyệt đối trên mọi bài kiểm tra. Họ không chỉ đạt thời gian huấn luyện nhanh nhất ở quy mô lớn mà còn dẫn đầu về hiệu năng trên từng bộ tăng tốc đơn lẻ ở tất cả bảy tác vụ, trở thành bên duy nhất tham gia đầy đủ các hạng mục .
Điểm nhấn đáng chú ý của mùa giải lần này là sự xuất hiện của các bài kiểm tra Hỗn hợp Chuyên gia (MoE), một kiến trúc đang thịnh hành nhờ khả năng xử lý hiệu quả với chi phí tính toán thấp hơn. Hai cái tên được đưa vào danh sách bao gồm:
NVIDIA là nền tảng duy nhất gửi kết quả cho cả hai bài kiểm tra mới này, tận dụng sức mạnh của hệ thống GB300 NVL72 kết hợp với các tối ưu hóa phần mềm tùy chỉnh như biểu đồ CUDA và định tuyến MoE tiên tiến . Về mặt kỹ thuật, DeepSeek-V3 sử dụng hàng loạt cải tiến "đỉnh cao" như Cơ chế Chú ý Tiềm ẩn Đa Đầu (MLA), phân đoạn chuyên gia chi tiết (160 chuyên gia được định tuyến), dự đoán đa token và cân bằng tải không cần hàm mất mát phụ — những yếu tố giúp tối ưu hóa hiệu quả huấn luyện một cách ngoạn mục
.
Đối tác của NVIDIA, CoreWeave, đã tạo nên một cột mốc đáng kinh ngạc khi huấn luyện thành công mô hình DeepSeek-V3 671B chỉ trong 2,02 phút. Thành tích này đạt được trên cụm 8.192 GPU NVIDIA GB300 NVL72 — cụm GB300 lớn nhất được ghi nhận trong kỳ đánh giá này — và hoạt động trên chính hạ tầng đám mây sẵn sàng phục vụ khách hàng của CoreWeave .
Đây là kết quả huấn luyện DeepSeek-V3 nhanh nhất từ trước đến nay, vượt mọi giới hạn trước đó, có được nhờ tối ưu toàn diện trên các lớp mạng, điều phối và lưu trữ .
So sánh giữa hai thế hệ chip mạnh nhất của NVIDIA cho thấy bước nhảy vọt về công nghệ:
Kỳ MLPerf này ghi nhận sự tham gia đông đảo kỷ lục từ 24 tổ chức với 95 hệ thống khác nhau, sử dụng 13 loại tăng tốc phần cứng — một minh chứng cho sự sôi động của thị trường AI .
Dù "cơn bão" NVIDIA vẫn cực kỳ mạnh mẽ, đối thủ AMD cũng cho thấy những tín hiệu đáng khích lệ. Nền tảng AMD Instinct MI355X sử dụng định dạng dấu phẩy động MXFP4 đã thể hiện hiệu năng rất cạnh tranh so với NVIDIA B200 trên hai bài toán fine-tune Llama 2-70B (chỉ kém 5%) và pre-training Llama 3.1-8B (kém 6%) . Điều này cho thấy cuộc đua về hiệu năng và chi phí trên mỗi token sẽ còn ngày càng hấp dẫn.
Để đạt được những kỷ lục ở quy mô hàng nghìn GPU, vai trò của mạng kết nối là sống còn. Các đối tác của NVIDIA đã mở rộng quy mô lên tới 8.192 GPU Blackwell, dựa trên nền tảng Spectrum-X Ethernet với các tính năng Định tuyến Thích ứng và Kiểm soát Tắc nghẽn. Công nghệ này giúp duy trì băng thông mạng gần mức lý thuyết, điều tối quan trọng cho các mô hình MoE vốn có kiểu giao tiếp "bùng nổ" (all-to-all communication) giữa các GPU .
Kết hợp miền kết nối NVLink với hạ tầng mạng mở rộng, NVIDIA cùng các đối tác đã lập hàng loạt kỷ lục ấn tượng khác về thời gian huấn luyện:
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
NVIDIA giành chiến thắng tuyệt đối tại MLPerf Training v6.0, dẫn đầu tất cả 7 bài kiểm tra về cả tốc độ huấn luyện quy mô lớn lẫn hiệu năng trên mỗi GPU [3].
NVIDIA giành chiến thắng tuyệt đối tại MLPerf Training v6.0, dẫn đầu tất cả 7 bài kiểm tra về cả tốc độ huấn luyện quy mô lớn lẫn hiệu năng trên mỗi GPU [3]. MLCommons giới thiệu hai bài kiểm tra mới dành cho kiến trúc Hỗn hợp Chuyên gia (MoE) đầy thách thức là DeepSeek V3 671B và GPT OSS 20B [3][10].
CoreWeave lập kỷ lục thế giới khi huấn luyện mô hình DeepSeek V3 671B chỉ trong 2,02 phút trên cụm 8.192 GPU NVIDIA GB300 NVL72 [8][26].