Tesis di balik peningkatan dramatis ini sederhana: revolusi AI beralih dari pelatihan (training) ke inferensi, dan beban kerja masa depan — sistem AI agen yang otonom dan multi-langkah — membutuhkan lebih banyak daya CPU daripada yang diperkirakan industri sebelumnya .
Beban kerja AI Agen diproyeksikan mencakup sekitar dua pertiga dari pasar server CPU senilai $220 miliar pada 2030 . Sistem ini mengoordinasikan tugas-tugas kompleks secara otonom, sangat bergantung pada CPU untuk penanganan data dan koordinasi di samping eksekusi model berbasis GPU .
Inferensi telah menjadi kasus penggunaan komputasi AI yang dominan. Pada tahun 2026, untuk pertama kalinya, beban kerja inferensi mengkonsumsi sekitar 60% dari kapasitas komputasi AI global, melampaui pelatihan . Pergeseran ini menguntungkan arsitektur yang sarat CPU karena melayani model dalam skala besar membutuhkan sejumlah besar CPU host, server inferensi, dan infrastruktur pendukung .
AMD juga melihat pasar komputasi berkinerja tinggi dan adaptif yang lebih luas mencapai $2 triliun pada 2030, naik dari $365 miliar pada 2025 . Pasar silikon pusat data saja diperkirakan akan melampaui $1 triliun .
Diumumkan di Advancing AI 2026 pada 23 Juli 2026, Helios adalah sistem rak AI terintegrasi penuh pertama AMD yang didinginkan dengan cairan, menggabungkan 72 GPU Instinct MI455X, CPU EPYC Venice, dan jaringan Pensando . Sistem ini dalam produksi penuh per Juli 2026, dengan pengiriman mitra dimulai pada akhir Q3 2026 (September 2026) dan peningkatan volume pada Q4 .
Rak ini memberikan hingga 2,9 exaflops throughput inferensi FP4 dan 1,4 exaflops throughput pelatihan FP8, dengan bandwidth interkoneksi skala-naik 260 TB/s . Harga untuk rak Helios yang terisi penuh diperkirakan sekitar $5,25 juta .
Dibangun di atas proses N2 (2nm) TSMC, CPU Venice hadir dengan hingga 256 inti per soket dengan mengemas 32 inti Zen 6c pada masing-masing dari 8 chiplet . Produksi dimulai di fasilitas TSMC Taiwan pada Mei 2026, dengan produksi masa depan direncanakan di fasilitas TSMC Arizona (meskipun volume di sana tidak diharapkan sebelum 2028) .
Venice saat ini sedang disampel ke pelanggan dan akan dikirim dalam rak Helios serta penyebaran server mandiri pada akhir 2026 dan awal 2027 . Varian EPYC 9006 SP7, yang dibuat untuk eksekusi agen berkepadatan tinggi, dijadwalkan dikirim pada kuartal keempat tahun 2026 .
AMD telah mengunci komitmen besar dari tiga perusahaan AI terkemuka, dengan total kira-kira 14 gigawatt kapasitas komputasi :
| Pelanggan | Komitmen | Detail |
|---|---|---|
| OpenAI | ~6 GW | Kesepakatan diumumkan Oktober 2025. ~10% ekuitas AMD diterbitkan sebagai waran kinerja. OpenAI memperkirakan Helios online mulai Q4 2026 . |
| Meta | ~6 GW | Kesepakatan diumumkan Februari 2026. Termasuk chip MI450-series khusus dan arsitektur rak Helios yang dikembangkan bersama melalui Open Compute Project. Meta masih memvalidasi platform EPYC dan menguji sistem Helios . |
| Anthropic | Hingga 2 GW | Kesepakatan diumumkan Juli 2026. AMD melakukan investasi ekuitas strategis hingga $5 miliar. Gigawatt pertama kapasitas GPU MI450-series diharapkan dikirim pada H1 2027 . |
Pelanggan tambahan termasuk Microsoft (menyebarkan rak Helios di pusat data Azure) dan Oracle (membangun superkluster Helios 50.000-GPU) .
Tumpukan perangkat lunak ROCm AMD telah membuat kemajuan substansial tetapi masih tertinggal dari CUDA milik Nvidia di area-area utama:
Apa yang berhasil:
Celah yang tersisa:
Intinya: ROCm kini layak produksi untuk inferensi dan kompetitif pada harga per token (dilaporkan 25–40% lebih murah daripada Nvidia untuk beban kerja inferensi pada perangkat keras yang setara), tetapi CUDA mempertahankan keunggulan berarti dalam alat, alur kerja pelatihan, dan luasnya dukungan kerangka kerja .
Pendapatan Q2 2026 AMD sangat mendukung arah strategis perusahaan:
| Metrik | Q2 2026 | Perubahan Tahun ke Tahun |
|---|---|---|
| Total pendapatan | $11,5 miliar | Rekor tertinggi |
| Pendapatan pusat data | $6,7 miliar | Lebih dari dua kali lipat |
| Pusat data sebagai % dari total | ~58% | Naik dari 42% tahun lalu |
| Pertumbuhan pendapatan CPU server | >70% | Didorong oleh inferensi/AI agen |
Manajemen mencatat dalam panggilan pendapatan bahwa "inferensi dan AI agen meningkatkan kebutuhan komputasi CPU server" sebagai pendorong struktural di balik peningkatan TAM . AMD mengharapkan pendapatan AI pusat data mencapai "puluhan miliar dolar" pada 2027, dengan pendapatan CPU server saja diperkirakan tumbuh lebih dari 70% pada 2027 .
Lintasan margin kotor: Saat AMD beralih dari menjual chip diskrit ke sistem rak terintegrasi seperti Helios — yang menggabungkan GPU, CPU, dan jaringan dalam satu paket — margin campuran mungkin menghadapi hambatan dibandingkan dengan penjualan chip murni. Pasar mengamati apakah AMD dapat mempertahankan ekspansi margin saat menjadi penyedia sistem, mirip dengan Nvidia.
Konsentrasi rantai pasokan TSMC: AMD sangat bergantung pada TSMC untuk produksi CPU (N2) dan GPU (N3/N4) terdepan . Venice sedang ditingkatkan di TSMC Taiwan, dan sementara AMD telah merencanakan produksi masa depan di fasilitas TSMC Arizona, kapasitas itu belum online untuk node terdepan . Ketegangan geopolitik seputar Taiwan dan persaingan untuk alokasi wafer TSMC dari Apple, Nvidia, dan lainnya tetap menjadi risiko jangka pendek yang material, terutama saat AMD berencana mengirimkan Helios dalam skala gigawatt mulai akhir 2026.
AMD menjalankan strategi yang jelas dan ambisius yang bertumpu pada titik infleksi dalam beban kerja AI — dari pelatihan ke inferensi, dari model terisolasi ke agen otonom. Peta jalan perangkat keras perusahaan (Helios dan Venice) sudah dalam produksi, pelanggan terbesarnya berkomitmen dalam skala yang belum pernah terjadi sebelumnya, dan hasil keuangannya mencerminkan pergeseran ini. Pertanyaan terbuka yang utama adalah apakah ROCm dapat menutup celah yang tersisa dengan CUDA cukup cepat dan apakah kendala rantai pasokan akan memungkinkan AMD memenuhi jadwal peningkatan yang agresif.