Det sätter press på Nvidias planer för Rubin-generationen. Enligt TrendForce och andra branschanalytiker utvärderar Nvidia minnesvarianter med lägre kapacitet för den kommande Rubin Ultra-processorn. Samtidigt uppges företaget redan ha minskat systemminnet i den rackbaserade Vera Rubin NVL72-plattformen.
Nvidia beskriver däremot inte förändringarna som nedgraderingar. Bolagets officiella linje är att det rör sig om olika produktvarianter och kundanpassningar. Oavsett ordval visar utvecklingen hur priset och tillgången på HBM4 nu påverkar själva utformningen av AI-infrastrukturen.
Från och med tredje kvartalet 2026 breddade Nvidia sin utvärdering av Rubin Ultras HBM-konfiguration. Den ursprungliga planen var en 12-Hi HBM4e-lösning, där "12-Hi" syftar på antalet minneslager i ett staplat HBM-paket. Nu testas fyra alternativ parallellt :
Någon slutlig specifikation är ännu inte fastställd . Enligt rapporterna beror breddningen dels på en väntad global DRAM-brist under 2027, som kan begränsa den waferkapacitet som är tillgänglig för HBM-produktion, dels på osäkerhet kring när HBM4e har kvalificerats hos de tre stora minnestillverkarna .
För Nvidia innebär flera alternativ en möjlighet att fortsätta leverera även om de mest avancerade 12-Hi HBM4e-paketen blir svåra att få fram i tillräckliga volymer. En lägre stapel eller en övergång till HBM4 kan däremot innebära kompromisser i minneskapacitet och prestanda.
För Vera Rubin är den rapporterade förändringen mer konkret. Nvidia uppges ha halverat den planerade SOCAMM-kapaciteten i Vera Rubin NVL72 från 192 GB till 96 GB per modul .
Enligt analyser som TrendForce och GF Securities hänvisar till skulle det totala Vera-CPU-minnet per rack då minska från ungefär 55 TB till 28 TB. GPU:ernas HBM4-kapacitet ska däremot ligga kvar på 20,7 TB per rack .
Syftet uppges vara att sänka kostnaderna och minska exponeringen mot begränsad tillgång. Minnet – HBM tillsammans med SOCAMM – beräknas stå för omkring 29 procent av den totala materialkostnaden, eller BOM, för Vera Rubin-plattformen . Det gör minnet till en av systemets största kostnadsposter, snarare än en underordnad komponent.
Nvidia har avvisat uppgifterna om att Vera- och Rubin-plattformarna har skurits ned på grund av HBM-brist. I ett blogginlägg den 7 augusti 2026 beskrev företaget konfigurationerna som olika SKU:er och kundspecifik finjustering, inte som nedgraderingar orsakade av leveransproblem .
Nvidia framhåller också att bolaget löpande anpassar beräkningskapacitet, nätverk och minne för att hitta rätt balans mellan prestanda och effektivitet för olika kunder . En SKU är i praktiken en specifik produktversion – exempelvis med en viss minnesmängd – som kan riktas mot en särskild typ av arbetslast eller prisnivå.
Vd Jensen Huang har samtidigt sagt att Samsung, SK Hynix och Micron alla är godkända som leverantörer av HBM4. I juni 2026 uppgav han att Vera Rubin var i full produktion och att Rubin, Rubin Ultra och Kyber-servrarna låg enligt plan . I juli avfärdade Huang rapporter om förseningar och sade att produktionen av Vera Rubin fortsatte i ”gigantiska” volymer .
Skillnaden mellan beskrivningarna är därför tydlig: TrendForce och andra analytiker ser de nya minnesalternativen som en beredskapsplan driven av tillgång och kostnader. Nvidia framställer dem som normal produktplanering för olika kundbehov.
HBM4 uppges vara slutsålt för hela 2026, medan DRAM-bristen väntas fortsätta in i 2027 . Det skapar ett långvarigt pris- och leveransproblem för Nvidias kommande plattformar – från Vera Rubin till Rubin Ultra och efterföljande produkter.
När minne står för omkring 29 procent av BOM-kostnaden i Vera Rubin NVL72 blir varje förändring i HBM- eller SOCAMM-konfigurationen strategiskt viktig . Nvidia behöver väga maximal prestanda mot möjligheten att faktiskt producera och leverera kompletta system i stora volymer.
För att få tillgång till tillräckliga mängder minne har Nvidia och SK Group presenterat ett strategiskt initiativ värt mer än 500 miljarder dollar, där ett långsiktigt samarbete med SK Hynix om HBM4 till Vera Rubin ingår . Några dagar senare meddelade Samsung Electronics och Broadcom ett separat samarbete värt 200 miljarder dollar .
Tillsammans motsvarar avtalen omkring 700 miljarder dollar i åtaganden. De illustrerar hur tillgången till avancerat minne har blivit en strategisk fråga i AI-chipindustrin – inte bara en detalj i komponentinköpen.
I stället för att förlita sig på en enda toppkonfiguration verkar Nvidia förbereda ett bredare utbud av SKU:er med olika stapelhöjd och minnesmängd . Det kan ge kunderna fler pris- och prestandanivåer och samtidigt göra det möjligt för Nvidia att fortsätta leverera om de mest avancerade HBM4e-varianterna blir en flaskhals.
Rapporterna pekar på ett verkligt kostnads- och leveranstryck. Nvidia uppges testa Rubin Ultra-varianter med mindre eller äldre HBM-konfigurationer och ha halverat SOCAMM-kapaciteten i Vera Rubin NVL72. Den slutliga specifikationen för Rubin Ultra är ännu inte offentlig.
Nvidia förnekar samtidigt att det rör sig om en påtvingad nedgradering och beskriver förändringarna som kundspecifika produktvarianter. Men de stora leveransavtalen och minnets växande andel av systemkostnaden talar för att HBM-bristen spelar en viktig roll bakom kulisserna.
Rubin-eran kommer därför inte enbart att avgöras av hur kraftfulla GPU:erna är. Minst lika avgörande blir om Nvidia kan få fram tillräckligt mycket av det avancerade minne som krävs för att hålla dem matade.