Keputusan ini menegaskan strategi Microsoft untuk tidak bergantung pada satu pemasok. Di Azure, AMD Helios akan berjalan berdampingan dengan rak Nvidia Vera Rubin NVL72, sehingga Microsoft memiliki dua platform utama untuk memperluas kapasitas AI-nya .
Microsoft tampaknya ingin mengurangi risiko gangguan pasokan sekaligus menghindari ketergantungan jangka panjang pada satu vendor . Strategi ini sejalan dengan pendekatan Microsoft yang tidak mengunci Azure dan Copilot pada satu model atau ekosistem perangkat keras tertentu .
CEO Microsoft Satya Nadella mengatakan Azure akan menjadi salah satu penyedia cloud pertama yang menerapkan infrastruktur AI rack-scale generasi berikutnya berbasis AMD Helios dan Nvidia Vera Rubin .
Bagi Microsoft, pilihan ganda ini dapat memberikan:
Dengan kata lain, Microsoft sedang melakukan diversifikasi infrastruktur AI—atau “mengamankan dua pilihan”—alih-alih mempertaruhkan ekspansi Azure pada satu pemasok saja.
AMD maupun Microsoft belum mengungkap harga resmi Helios. Namun, estimasi Futurum Group menunjukkan adanya perbedaan harga yang cukup besar:
Artinya, Helios diperkirakan sekitar 40% lebih mahal jika dibandingkan berdasarkan harga per rak . Premium tersebut dikaitkan dengan kapasitas memori yang lebih besar, arsitektur berbasis standar terbuka, serta integrasi komponen AMD yang mencakup GPU, CPU, dan jaringan .
Namun, angka tersebut masih berupa estimasi analis, bukan harga yang dikonfirmasi oleh kedua perusahaan.
AMD berpendapat bahwa harga awal Helios yang lebih tinggi dapat diimbangi oleh efisiensi pada pengoperasian AI. Berdasarkan data laboratorium AMD, Helios diklaim mampu memberikan:
Lisa Su, CEO AMD, menyebut Helios menawarkan setidaknya 15% performa lebih tinggi pada model-model terbesar, kapasitas HBM 50% lebih besar, dan hingga 30% lebih banyak token per dolar dibandingkan pesaingnya .
Meski demikian, klaim tersebut belum menjadi hasil uji produksi yang independen. Futurum Group mengingatkan bahwa perbandingan AMD masih berupa perhitungan vendor terhadap produk pesaing yang belum dikirim secara luas. Keunggulan performa dan biaya tersebut baru dapat diuji secara nyata setelah kedua sistem beroperasi dalam lingkungan produksi .
Helios merupakan sistem AI rack-scale berpendingin cairan. Berbeda dari server biasa yang menggabungkan sejumlah akselerator, sistem ini dirancang sebagai satu unit komputasi besar yang mengintegrasikan GPU, CPU, memori, dan jaringan.
| Komponen | Spesifikasi |
|---|---|
| GPU | 72 AMD Instinct MI455X |
| Arsitektur GPU | CDNA 5, dengan chiplet 2 nm/3 nm dari TSMC |
| Transistor per GPU | 320 miliar |
| CPU | 18 AMD EPYC generasi keenam berkode “Venice”, satu CPU per compute tray |
| Jaringan | AMD Pensando “Vulcano” 800 AI NIC, dengan Ethernet 800 Gbps |
| Interkoneksi scale-up | UALink, yaitu Ultra Accelerator Link yang ditransmisikan melalui Ethernet |
| Interkoneksi scale-out | Selaras dengan spesifikasi Ultra Ethernet Consortium |
| Memori HBM4 | Hingga 31 TB per rak |
| Memori per GPU | 432 GB, terdiri dari 12 tumpukan HBM4 berkapasitas 36 GB |
| Bandwidth memori per GPU | 19,6 TB/detik |
| Bandwidth memori agregat | Hingga sekitar 1,7 PB/detik per rak |
| Performa FP4 | 2,9 exaFLOPS per rak |
| Performa FP8 | 1,4 exaFLOPS per rak |
| Bandwidth scale-up | 260 TB/detik |
| Bandwidth scale-out | 43 TB/detik |
| Bentuk fisik | 18 compute tray berpendingin cairan, masing-masing berisi empat GPU, ditambah enam switch tray |
Setiap compute tray menggabungkan empat GPU MI455X, satu CPU EPYC Venice, dan komponen jaringan Pensando. Seluruh GPU tersebut dihubungkan melalui UALink agar 72 GPU dapat bekerja sebagai satu kesatuan komputasi .
Selain Microsoft, AMD telah menyebut sejumlah pelanggan awal untuk Helios, yaitu:
Sementara itu, Anthropic belum disebut secara publik sebagai pelanggan awal Helios dalam pengumuman-pengumuman besar yang tersedia hingga Juli 2026 . Karena itu, belum ada dasar sumber yang cukup untuk menyatakan bahwa Anthropic telah berkomitmen menggunakan sistem tersebut.
Keputusan Microsoft menunjukkan bahwa persaingan AI kini tidak lagi hanya soal siapa yang membuat GPU tercepat. Vendor juga harus menawarkan satu paket lengkap yang mencakup CPU, memori berkecepatan tinggi, interkoneksi, jaringan antarrak, pendinginan, dan perangkat lunak.
Helios menonjolkan kapasitas memori HBM4 yang besar serta konektivitas berbasis Ethernet dan standar terbuka. Karakteristik ini penting untuk inferensi model besar, karena kapasitas dan bandwidth memori dapat memengaruhi jumlah token yang diproses serta biaya setiap permintaan .
Pengiriman Helios diperkirakan dimulai pada paruh kedua 2026. Setelah sistem ini digunakan di lingkungan produksi Azure, hasil benchmark nyata akan menjadi penentu apakah klaim AMD tentang keunggulan performa dan biaya benar-benar bertahan di luar pengujian laboratorium .