Laporan TrendForce dan sejumlah analis menyebut Nvidia sedang mengevaluasi varian memori yang lebih rendah untuk GPU Rubin Ultra. Di sisi lain, kapasitas memori sistem Vera Rubin NVL72 dilaporkan telah dikurangi. Nvidia sendiri membingkai perubahan tersebut bukan sebagai downgrade akibat kelangkaan komponen, melainkan sebagai perencanaan produk untuk segmen pelanggan dan beban kerja yang berbeda.
Perbedaan sudut pandang ini penting. Pasalnya, harga dan ketersediaan HBM4 kini tidak lagi sekadar persoalan rantai pasok, tetapi mulai memengaruhi arah strategis jajaran perangkat keras AI Nvidia.
Mulai kuartal III 2026, Nvidia memperluas evaluasi konfigurasi HBM Rubin Ultra. Sebelumnya, desain ini berfokus pada konfigurasi 12-Hi HBM4e. Kini, tiga alternatif lain ikut diuji secara paralel :
Belum ada spesifikasi final yang ditetapkan . Menurut laporan, evaluasi tersebut berkaitan dengan proyeksi kekurangan DRAM global pada 2027 yang dapat membatasi kapasitas wafer untuk produksi HBM. Nvidia juga menghadapi ketidakpastian mengenai jadwal kualifikasi HBM4e dari tiga produsen memori utama .
Secara sederhana, konfigurasi 8-Hi menggunakan tumpukan die DRAM yang lebih rendah dibandingkan 12-Hi. Sementara itu, HBM4e merupakan pengembangan dari HBM4. Pilihan tersebut dapat membantu Nvidia menjaga volume pengiriman apabila konfigurasi paling tinggi belum tersedia dalam jumlah memadai, meski konsekuensinya bisa berupa kapasitas memori atau tingkat performa yang berbeda.
Perubahan pada platform Vera Rubin disebut lebih konkret. Nvidia dilaporkan memangkas setengah kapasitas memori SOCAMM pada sistem rack-scale Vera Rubin NVL72, dari 192 GB menjadi 96 GB per modul .
Berdasarkan analisis GF Securities yang dikutip TrendForce, total memori CPU Vera per rak dapat turun dari sekitar 55 TB menjadi 28 TB. Namun, kapasitas HBM4 pada GPU tetap 20,7 TB per rak .
Langkah ini dikaitkan dengan upaya menekan biaya dan mengurangi tekanan pasokan. Biaya memori—yang mencakup HBM dan SOCAMM—diperkirakan telah mencapai sekitar 29% dari total bill of materials (BOM) sistem Vera Rubin . BOM adalah total biaya komponen yang digunakan untuk membangun sebuah sistem.
Sejumlah laporan mengingatkan bahwa perubahan yang tampak seperti pemangkasan spesifikasi bisa saja merupakan pengujian beberapa SKU khusus pelanggan. Artinya, Nvidia mungkin menyiapkan tingkatan memori yang berbeda untuk kebutuhan komputasi yang berbeda, bukan mengurangi satu spesifikasi flagship secara menyeluruh .
Interpretasi ini sejalan dengan penjelasan resmi Nvidia.
Dalam unggahan blog pada 7 Agustus 2026, Nvidia membantah spekulasi bahwa Vera dan Rubin dikurangi karena kelangkaan HBM. Perusahaan menyatakan konfigurasi yang dibahas merupakan SKU berbeda dan penyesuaian khusus pelanggan, bukan downgrade yang dipaksakan oleh keterbatasan pasokan .
Nvidia juga mengatakan bahwa perusahaan terus menyesuaikan komputasi, jaringan, dan memori untuk mencapai kombinasi performa serta efisiensi terbaik bagi pelanggan .
CEO Jensen Huang sebelumnya menyatakan pada Juni 2026 bahwa tiga produsen memori utama—Samsung, SK Hynix, dan Micron—telah mendapatkan sertifikasi untuk memasok HBM4. Ia juga mengatakan Vera Rubin telah memasuki produksi penuh, sementara server Rubin, Rubin Ultra, dan Kyber masih sesuai jadwal .
Pada Juli 2026, Huang kembali menepis laporan penundaan dan mengatakan produksi Vera Rubin berjalan dalam volume yang “sangat besar” .
Dengan demikian, perbedaan pandangannya cukup jelas: TrendForce dan analis melihat perluasan opsi HBM sebagai rencana cadangan yang dipicu tekanan pasokan, sedangkan Nvidia menyebutnya sebagai strategi normal untuk menyiapkan varian produk bagi beban kerja pelanggan yang berbeda.
Pasokan HBM4 dilaporkan telah habis dipesan untuk seluruh 2026, sementara kekurangan DRAM diperkirakan berlanjut hingga 2027 . Situasi ini menciptakan tekanan harga dan ketersediaan bagi berbagai platform Nvidia, mulai dari Vera Rubin hingga Rubin Ultra.
HBM bukan komponen pendukung biasa. Memori ini dipasang dekat dengan akselerator AI untuk menyediakan bandwidth sangat tinggi. Jika pasokannya terbatas, peningkatan kemampuan GPU tidak otomatis dapat diterjemahkan menjadi lebih banyak sistem yang siap dikirim.
Pada sistem Vera Rubin NVL72, memori diperkirakan menyumbang sekitar 29% dari total BOM . Porsi sebesar ini menjadikan HBM dan SOCAMM salah satu pendorong biaya utama, bukan sekadar komponen tambahan.
Karena itu, mengurangi kapasitas pada varian tertentu dapat membantu Nvidia mengendalikan harga sistem dan mengamankan lebih banyak unit untuk pengiriman. Namun, keputusan tersebut juga harus mempertimbangkan jenis beban kerja yang dapat ditangani setiap varian.
Untuk mengamankan kapasitas produksi, Nvidia dan SK Group mengumumkan inisiatif strategis bernilai lebih dari 500 miliar dolar AS, termasuk kemitraan pasokan HBM jangka panjang dengan SK Hynix untuk generasi Vera Rubin . Beberapa hari kemudian, Samsung Electronics dan Broadcom mengumumkan kolaborasi terpisah senilai 200 miliar dolar AS .
Jika digabungkan, nilai kedua inisiatif tersebut mencapai sekitar 700 miliar dolar AS. Angka ini menunjukkan betapa pentingnya mengamankan pasokan memori dengan harga yang dapat diterima bagi seluruh ekosistem chip AI.
Alih-alih bergantung pada satu konfigurasi 12-Hi HBM4e, Nvidia tampaknya menyiapkan portofolio SKU yang lebih luas. Perbedaannya dapat mencakup tinggi tumpukan HBM dan kapasitas memori untuk menyesuaikan harga, kebutuhan pelanggan, serta ketersediaan komponen .
Strategi ini memberi Nvidia ruang untuk terus mengirimkan produk dalam volume besar ketika HBM4e kelas tertinggi sulit diperoleh. Jika konfigurasi 12-Hi HBM4e belum dapat diproduksi atau divalidasi sesuai jadwal, varian 8-Hi HBM4e atau HBM4 dapat menjadi alternatif untuk mempertahankan pasokan ke pelanggan.
Laporan yang beredar menunjukkan bahwa tekanan pasokan dan biaya memang memengaruhi cara Nvidia merancang produk era Rubin. Rubin Ultra dilaporkan sedang diuji dengan empat opsi konfigurasi HBM, sedangkan kapasitas SOCAMM pada sistem Vera Rubin NVL72 disebut turun dari 192 GB menjadi 96 GB per modul.
Nvidia membantah bahwa perubahan itu merupakan downgrade yang dipaksakan kelangkaan. Menurut perusahaan, konfigurasi tersebut adalah SKU berbeda dan penyesuaian untuk kebutuhan pelanggan.
Namun, kesepakatan pasokan bernilai ratusan miliar dolar serta meningkatnya porsi biaya memori memperlihatkan bahwa keterbatasan HBM telah menjadi faktor penting dalam peta jalan Nvidia. Spesifikasi final Rubin Ultra belum diumumkan, tetapi arahnya sudah terlihat: generasi baru perangkat keras AI akan ditentukan bukan hanya oleh kemampuan GPU, melainkan juga oleh seberapa banyak memori yang tersedia dan berapa biaya untuk mendapatkannya.