Nvidia beskriver imidlertid endringene som vanlig produktplanlegging for ulike kundebehov, ikke som nedgraderinger på grunn av komponentmangel. Uansett ordvalg viser utviklingen hvor stor innflytelse minnepris og minnetilgang nå har på veikartet for AI-maskinvare.
Fra tredje kvartal 2026 skal Nvidia ha utvidet vurderingen av minnekonfigurasjonen i Rubin Ultra. Den opprinnelige planen var én grunnvariant med 12-Hi HBM4e, altså en HBM-stakk bygget av tolv minnelag. TrendForce rapporterer at Nvidia nå tester fire alternativer parallelt :
Det er ikke tatt noen endelig beslutning . Alternativene skal ses i lys av en ventet global DRAM-mangel i 2027, som kan begrense produksjonskapasiteten tilgjengelig for HBM. I tillegg er det fortsatt usikkerhet rundt når HBM4e blir kvalifisert hos de tre store minneprodusentene .
Lavere stakker eller bruk av HBM4 i stedet for HBM4e kan gjøre det enklere å sikre leveranser. Samtidig kan det påvirke kapasitet og ytelse per brikke – særlig i de mest krevende AI-arbeidslastene.
For Vera Rubin-plattformen er den rapporterte endringen mer konkret. Nvidia skal ha besluttet å halvere SOCAMM-kapasiteten i Vera Rubin NVL72, fra 192 GB til 96 GB per modul .
Ifølge analyser gjengitt av TrendForce og GF Securities, vil det samlede CPU-minnet i hvert rack dermed falle fra rundt 55 TB til 28 TB. GPU-enes HBM4-kapasitet skal derimot forbli uendret på 20,7 TB per rack .
Hensikten skal være å redusere kostnader og lette presset på leveransene. Minne utgjør angivelig rundt 29 prosent av den totale materialkostnaden – ofte omtalt som BOM, eller «bill of materials» – i Vera Rubin-plattformen .
Nvidia har avvist spekulasjonene om at Vera- og Rubin-produktene er blitt redusert på grunn av HBM-mangel. I et blogginnlegg 7. august 2026 skrev selskapet at konfigurasjonene det er snakk om, er ulike SKU-er og kundetilpasset finjustering, ikke nedgraderinger tvunget frem av forsyningsproblemer .
En SKU er i praksis en bestemt produktvariant. Det kan for eksempel bety at kunder med ulike arbeidslaster får forskjellige nivåer av minne, i stedet for at alle kjøper én identisk toppmodell.
Nvidia sier også at selskapet løpende justerer datakraft, nettverk og minne for å finne den beste balansen mellom ytelse og effektivitet for kundene .
Toppsjef Jensen Huang har samtidig forsøkt å dempe bekymringen for leveranseproblemer. I juni 2026 bekreftet han at Samsung, SK Hynix og Micron var godkjent som leverandører av HBM4. Han sa også at Vera Rubin var i full produksjon, mens Rubin, Rubin Ultra og Kyber-serverne var i rute . I juli avviste Huang meldinger om forsinkelser og sa at Vera Rubin-produksjonen gikk videre i «gigantiske» volumer .
Dermed står to tolkninger mot hverandre: TrendForce og andre analytikere ser den bredere testingen som en beredskapsplan mot knapphet, mens Nvidia omtaler den som normal planlegging av produktvarianter.
HBM4 skal være utsolgt for hele 2026, samtidig som DRAM-mangelen ventes å fortsette gjennom 2027 . Det gir en vedvarende utfordring for alle Nvidias nye plattformer – fra Vera Rubin til Rubin Ultra og senere generasjoner.
HBM er ikke vanlig systemminne. Det er stablede minnebrikker som plasseres tett på AI-akseleratoren for å levere svært høy båndbredde. Når denne typen minne blir knapp, kan det begrense hvor mange komplette AI-systemer som faktisk kan bygges, selv om selve GPU-logikken er klar.
Når HBM og SOCAMM samlet utgjør rundt 29 prosent av materialkostnaden i Vera Rubin NVL72, er minnet ikke lenger bare en støttende komponent. Det er blitt en av de viktigste kostnadsdriverne i systemet .
Det forklarer hvorfor Nvidia kan være villig til å tilby flere minnenivåer. En litt mindre kraftig variant kan gjøre det mulig å levere flere systemer, eller å holde prisen og marginene under kontroll, dersom de mest avanserte HBM4e-stakkene er vanskelige å få tak i.
Nvidia og SK Group har kunngjort et strategisk initiativ verdt mer enn 500 milliarder dollar, som blant annet omfatter et langsiktig samarbeid med SK Hynix om HBM4 til Vera Rubin-generasjonen . Kort tid senere inngikk Samsung Electronics og Broadcom et separat samarbeid verdsatt til 200 milliarder dollar .
Avtalene er ikke nødvendigvis rene kjøpskontrakter for HBM, men de illustrerer hvor store ressurser som nå brukes på å sikre kapasitet i AI-brikkeøkosystemet. Til sammen peker de mot en samlet strategisk innsats på rundt 700 milliarder dollar.
I stedet for å satse alt på én Rubin Ultra-modell med 12-Hi HBM4e, ser Nvidia ut til å forberede et bredere produktspekter. Forskjeller i antall minnelag og minnetype kan gjøre det mulig å tilpasse produktene til både pris, arbeidslast og tilgjengelighet .
Hvis 12-Hi HBM4e blir forsinket eller vanskelig å produsere i store volumer, kan Nvidia i teorien fortsatt levere Rubin Ultra med 8-Hi HBM4e eller HBM4. Det kan gi lavere ytelse eller kapasitet per brikke, men samtidig holde leveransene i gang.
Rapportene peker på et reelt kostnads- og forsyningspress. Nvidia skal vurdere HBM-varianter med lavere kapasitet for Rubin Ultra, og Vera Rubin NVL72 skal ha fått redusert SOCAMM-minne. Den endelige Rubin Ultra-spesifikasjonen er imidlertid ikke offentlig fastsatt.
Nvidia avviser at selskapet er tvunget til å nedgradere produktene, og omtaler endringene som kundetilpassede SKU-er. Men de store leveranseavtalene og minnes økende andel av systemkostnaden gjør én ting tydelig: Rubin-generasjonen vil ikke bare avgjøres av hvor kraftige GPU-ene er. Den vil også avgjøres av hvor mye avansert minne Nvidia klarer å sikre – og til hvilken pris.