Pada masa yang sama, Microsoft turut bersedia menggunakan rak Nvidia Vera Rubin NVL72. Langkah ini menunjukkan bahawa gergasi awan tersebut tidak mahu bergantung kepada satu pembekal sahaja untuk membina kapasiti AI generasi seterusnya .
Strategi Microsoft adalah untuk membahagikan infrastruktur antara AMD Helios dan Nvidia Vera Rubin. Pendekatan ini boleh mengurangkan risiko rantaian bekalan, mengelakkan kebergantungan kepada satu vendor serta memberikan Microsoft lebih banyak kelonggaran ketika merundingkan harga dan bekalan .
Strategi tersebut selari dengan pendekatan Microsoft yang tidak terikat kepada satu model AI dalam Azure dan Copilot . Ketua Pegawai Eksekutif Microsoft, Satya Nadella, berkata Azure akan menjadi antara penyedia awan terawal yang menggunakan infrastruktur AI berskala rak berasaskan kedua-dua AMD Helios dan Nvidia Vera Rubin .
Ringkasnya, Microsoft sedang “menyebarkan pertaruhan” dalam perlumbaan perkakasan AI: jika salah satu pembekal berdepan kekangan bekalan atau kelewatan, Microsoft masih mempunyai platform alternatif untuk menyokong pertumbuhan perkhidmatannya.
Harga rasmi tidak didedahkan oleh AMD atau Microsoft. Namun, anggaran Kumpulan Futurum meletakkan kos satu rak pada paras berikut:
| Sistem | Anggaran harga setiap rak |
|---|---|
| AMD Helios | AS$5 juta hingga AS$5.5 juta |
| Nvidia Vera Rubin NVL72 | AS$3.5 juta hingga AS$4 juta |
Berdasarkan anggaran itu, Helios kira-kira 40% lebih mahal berbanding Vera Rubin NVL72 untuk setiap rak . Angka ini masih merupakan anggaran penganalisis dan bukannya harga jualan yang disahkan.
AMD menyatakan premium tersebut disokong oleh kapasiti memori yang lebih besar, seni bina berasaskan piawaian terbuka serta gabungan lengkap GPU Instinct, CPU EPYC dan teknologi rangkaian Pensando .
AMD berhujah bahawa harga pembelian awal yang lebih tinggi boleh diimbangi oleh kecekapan operasi yang lebih baik. Berdasarkan data makmal AMD, Helios menawarkan:
Ketua Pegawai Eksekutif AMD, Lisa Su, membentangkan angka tersebut dalam acara Advancing AI 2026. Beliau berkata Helios menawarkan sekurang-kurangnya 15% lebih prestasi untuk model terbesar, 50% lebih kapasiti HBM serta sehingga 30% lebih banyak token bagi setiap dolar .
Namun, angka ini belum boleh dianggap sebagai keputusan muktamad. Kumpulan Futurum mengingatkan bahawa dakwaan kelebihan 15% dari segi prestasi dan 30% dari segi token setiap dolar masih berdasarkan pengiraan vendor terhadap pesaing yang belum dihantar secara komersial. Prestasi sebenar perlu diuji dalam persekitaran pengeluaran .
Helios ialah sistem AI berskala rak yang disejukkan menggunakan cecair. Ia direka supaya puluhan GPU dapat berfungsi sebagai satu kelompok pengkomputeran berprestasi tinggi .
| Komponen | Spesifikasi |
|---|---|
| GPU | 72 × AMD Instinct MI455X |
| Seni bina GPU | CDNA 5, menggunakan chiplet 2nm/3nm keluaran TSMC |
| Transistor setiap GPU | 320 bilion |
| CPU | 18 × AMD EPYC Venice generasi keenam, satu bagi setiap dulang pengkomputeran |
| Rangkaian | AMD Pensando Vulcano 800 AI NIC, Ethernet 800 Gbps dan sehingga 2.4 Tbps scale-out bagi setiap GPU |
| Sambungan scale-up | UALink, iaitu Ultra Accelerator Link melalui Ethernet |
| Sambungan scale-out | Selaras dengan spesifikasi Ultra Ethernet Consortium |
| Jumlah memori HBM4 | Sehingga 31 TB bagi setiap rak |
| Memori setiap GPU | 432 GB, melalui 12 susunan HBM4 berkapasiti 36 GB setiap satu |
| Lebar jalur memori setiap GPU | 19.6 TB/s |
| Lebar jalur memori keseluruhan | Sehingga 1.7 PB/s bagi setiap rak |
| Prestasi FP4 | 2.9 exaFLOPS bagi setiap rak |
| Prestasi FP8 | 1.4 exaFLOPS bagi setiap rak |
| Lebar jalur scale-up | 260 TB/s |
| Lebar jalur scale-out | 43 TB/s |
| Reka bentuk fizikal | 18 dulang pengkomputeran disejukkan cecair, setiap satu dengan empat GPU, serta enam dulang suis; mematuhi format OCP Open Rack Wide |
| Prestasi setiap GPU | 40 PFLOPS FP4 dan 20 PFLOPS FP8 |
Setiap dulang pengkomputeran mengandungi empat GPU MI455X, satu CPU EPYC Venice dan komponen rangkaian Pensando. Kesemua GPU disambungkan melalui UALink supaya 72 GPU dalam satu rak boleh beroperasi seolah-olah sebagai satu unit pengkomputeran .
Selain Microsoft, AMD telah menamakan beberapa pelanggan awal yang akan menggunakan rak Helios :
Anthropic pula tidak dinamakan secara terbuka sebagai pelanggan awal Helios dalam pengumuman utama yang tersedia setakat Julai 2026 . Maka, walaupun Anthropic sering disebut dalam perbincangan tentang penggunaan infrastruktur AI, tiada komitmen Helios daripada syarikat itu yang disahkan oleh sumber-sumber tersebut.
Komitmen Microsoft terhadap kedua-dua Helios dan Vera Rubin menunjukkan bahawa persaingan perkakasan AI kini semakin melangkaui soal GPU semata-mata. Penyedia awan berskala besar bukan sahaja mencari cip paling pantas, malah menilai kapasiti memori, rangkaian, penggunaan tenaga, perisian dan kestabilan bekalan.
Helios mungkin menarik untuk beban kerja inferens berskala besar kerana kapasiti HBM4 yang tinggi dan sambungan Ethernet terbuka. Bagi model AI yang besar, lebih banyak memori dan lebar jalur boleh membantu meningkatkan jumlah token yang diproses serta mengurangkan kos setiap token .
Helios dijangka mula dihantar pada separuh kedua 2026. Ujian sebenar terhadap dakwaan AMD akan bermula apabila rak tersebut digunakan dalam pengeluaran dan penanda aras bebas diterbitkan. Buat masa ini, keputusan Microsoft lebih menggambarkan strategi pengurusan risiko dan kepelbagaian platform — bukan pengisytiharan bahawa satu sistem telah mengatasi sistem yang lain secara muktamad .