Microsoft cố tình chia tách hạ tầng AI thế hệ mới giữa AMD Helios và Nvidia Vera Rubin để giảm rủi ro chuỗi cung ứng và tránh bị phụ thuộc vào một nhà cung cấp duy nhất . Điều này tương tự cách tiếp cận 'không phụ thuộc mô hình' (model-agnostic) của họ trong Azure và Copilot . CEO Satya Nadella xác nhận: "Chúng tôi sẽ là một trong những nhà cung cấp đám mây đầu tiên triển khai hạ tầng AI dạng rack thế hệ tiếp theo dựa trên AMD Helios và Nvidia Vera Rubin" . Chiến lược này được giới công nghệ mô tả là "phòng thủ rủi ro" (hedging bets) trong việc mua sắm hạ tầng AI .
Cả AMD và Microsoft đều không công bố giá chính thức, nhưng ước tính từ hãng phân tích Futurum Group đưa ra con số so sánh rõ ràng:
Như vậy, Helios đắt hơn khoảng 40% trên mỗi rack . Mức giá cao hơn phản ánh dung lượng bộ nhớ lớn hơn, kiến trúc mở và danh mục tích hợp CPU-GPU-mạng của AMD .
AMD lập luận rằng chi phí ban đầu cao hơn của Helios được bù đắp bằng hiệu suất vượt trội. Theo số liệu phòng thí nghiệm của AMD, Helios mang lại :
CEO AMD Lisa Su trình bày các con số này tại sự kiện Advancing AI 2026, tuyên bố Helios mang lại "hiệu suất cao hơn 15% so với đối thủ trên các mô hình lớn nhất, dung lượng HBM cao hơn 50% và nhiều hơn tới 30% token trên mỗi đô la" .
Tuy nhiên, các nhà phân tích cảnh báo đây mới chỉ là ước tính trước sản xuất. Futurum Group nhận xét: "Lợi thế hiệu suất 15% và tuyên bố tokens-per-dollar 30% của AMD vẫn là phép tính nội bộ so với một đối thủ chưa xuất xưởng và sẽ được kiểm chứng trong quá trình sản xuất trong vòng hai quý tới" .
AMD Helios là hệ thống quy mô rack được thiết kế riêng, làm mát bằng chất lỏng, đại diện cho sản phẩm phần cứng AI toàn diện nhất của AMD từ trước đến nay :
| Thành phần | Thông số kỹ thuật |
|---|---|
| GPU | 72x AMD Instinct MI455X |
| Kiến trúc GPU | CDNA 5 (chiplet lai 2nm/3nm tại TSMC) |
| Số bóng bán dẫn mỗi GPU | 320 tỷ |
| CPU | 18x AMD EPYC thế hệ 6 "Venice" (một CPU mỗi khay tính toán, tới 256 lõi mỗi CPU) |
| Mạng | AMD Pensando "Vulcano" 800 AI NIC (800 Gbps Ethernet, lên tới 2,4 Tbps băng thông mở rộng mỗi GPU) |
| Kết nối mở rộng trong rack | UALink (Ultra Accelerator Link tunnel qua Ethernet) |
| Kết nối mở rộng giữa các rack | Tuân thủ Ultra Ethernet Consortium (UEC) |
| Tổng bộ nhớ HBM4 | 31 TB mỗi rack |
| Bộ nhớ mỗi GPU | 432 GB (12 chồng HBM4, mỗi chồng 36 GB) |
| Băng thông bộ nhớ mỗi GPU | 19,6 TB/s |
| Băng thông bộ nhớ tổng hợp | 1,7 PB/s mỗi rack |
| Hiệu suất FP4 | 2,9 exaFLOPS mỗi rack |
| Hiệu suất FP8 | 1,4 exaFLOPS mỗi rack |
| Băng thông mở rộng trong rack | 260 TB/s |
| Băng thông mở rộng giữa các rack | 43 TB/s |
| Kiểu dáng | 18 khay tính toán làm mát bằng chất lỏng (mỗi khay 4 GPU) + 6 khay chuyển mạch, tuân thủ OCP Open Rack Wide |
| Hiệu suất mỗi GPU | 40 PFLOPS FP4, 20 PFLOPS FP8 |
Mỗi khay tính toán chứa bốn GPU MI455X, một CPU EPYC Venice và mạng Pensando, tất cả kết nối qua giao thức UALink, cho phép 72 GPU hoạt động như một khối tính toán duy nhất .
AMD đã xác nhận các khách hàng Helios ban đầu sau :
Một cái tên đáng chú ý vắng mặt: Anthropic không được công bố là khách hàng Helios ban đầu trong bất kỳ thông báo chính thức nào tính đến tháng 7 năm 2026 .
Quyết định của Microsoft khi triển khai cả AMD Helios và Nvidia Vera Rubin cho thấy thị trường phần cứng AI đã bước vào một giai đoạn mới. Thay vì phụ thuộc vào một nhà cung cấp duy nhất, các ông lớn trung tâm dữ liệu (hyperscaler) đang đầu tư vào sự đa dạng nền tảng để đảm bảo nguồn cung, cải thiện đòn bẩy thương lượng và tiếp cận các đặc tính hiệu suất khác biệt .
AMD Helios, với 31 TB bộ nhớ HBM4 khổng lồ và kết nối mở dựa trên Ethernet, đặc biệt phù hợp cho các khối lượng công việc suy luận quy mô lớn, nơi dung lượng và băng thông bộ nhớ trực tiếp thúc đẩy thông lượng và chi phí trên mỗi token . Với lô hàng dự kiến trong nửa cuối năm 2026, thử thách thực sự sẽ đến khi các điểm chuẩn sản xuất được công bố và những tuyên bố cạnh tranh có thể được xác minh ở quy mô lớn .