Rapporter fra TrendForce og andre analysehuse peger på, at Nvidia tester versioner af den kommende Rubin Ultra-GPU med mindre eller ældre HBM-konfigurationer. Samtidig skulle virksomheden allerede have reduceret systemhukommelsen i Vera Rubin NVL72, et rackbaseret AI-system.
Nvidia afviser dog, at der er tale om en nedgradering fremtvunget af mangel på komponenter. Ifølge selskabet er der i stedet tale om forskellige produktvarianter og tilpasninger til bestemte kunder. Uanset formuleringen viser udviklingen, hvor stor betydning pris og adgang til HBM4 har fået for Nvidias produktplaner.
Fra tredje kvartal 2026 udvidede Nvidia angiveligt sin evaluering af Rubin Ultras hukommelseskonfiguration. Den oprindelige plan var én 12-Hi HBM4e-konfiguration, men selskabet undersøger nu fire muligheder parallelt :
“Hi” henviser til antallet af hukommelseslag i en HBM-stak. En 8-Hi-variant har altså færre lag end en 12-Hi-variant, mens HBM4e er en videreudvikling af HBM4.
Der er endnu ikke truffet en endelig beslutning om Rubin Ultras specifikationer . Ifølge TrendForce skyldes de parallelle tests både en forventet global DRAM-mangel i 2027 og usikkerhed om, hvornår HBM4e er færdigvalideret hos de tre store hukommelsesproducenter .
På Vera Rubin-platformen er den rapporterede ændring mere konkret. Nvidia skulle have besluttet at halvere kapaciteten i SOCAMM-modulerne i Vera Rubin NVL72 fra 192 GB til 96 GB pr. modul .
Ifølge analyser omtalt af TrendForce og GF Securities vil det sænke den samlede Vera CPU-hukommelse pr. rack fra cirka 55 TB til 28 TB. GPU’ernes HBM4-kapacitet skulle derimod forblive uændret på 20,7 TB pr. rack .
Formålet skulle være at reducere omkostningerne og lette presset på leverancerne. Hukommelse udgør angiveligt omkring 29 procent af den samlede styklistepris – også kaldet BOM, eller “bill of materials” – for Vera Rubin-platformen . Hukommelsen er dermed ikke længere blot en underordnet komponent, men en af de vigtigste omkostningsposter i systemet.
Flere kilder peger på, at det, der ligner en reduktion af specifikationerne, kan være Nvidia, der afprøver flere kundeorienterede SKU’er. Det vil sige forskellige hukommelsesniveauer til forskellige arbejdsbelastninger og prisområder, snarere end én enkelt flagship-model med en lavere specifikation .
Den forklaring ligger tæt på Nvidias egen udlægning af sagen.
I et blogindlæg 7. august 2026 afviste Nvidia spekulationer om, at Vera- og Rubin-produkterne var blevet skåret ned på grund af mangel på HBM. Selskabet beskrev de omtalte konfigurationer som forskellige SKU’er og kundeorienteret finjustering – ikke som en nedgradering fremtvunget af leveranceproblemer .
Nvidia fremhævede samtidig, at virksomheden løbende tilpasser beregningskraft, netværk og hukommelse for at finde den bedste balance mellem ydeevne og effektivitet for kunderne .
Topchef Jensen Huang har også forsøgt at dæmpe bekymringerne om leverancerne. I juni 2026 bekræftede han, at Samsung, SK Hynix og Micron alle var godkendt som leverandører af HBM4 til Vera Rubin. Han sagde samtidig, at Vera Rubin var i fuld produktion, mens Rubin, Rubin Ultra og Kyber-serverne var på rette spor .
I juli afviste Huang desuden meldinger om forsinkelser og sagde, at produktionen af Vera Rubin fortsatte i “gigantiske” mængder .
Konflikten handler derfor især om fortolkningen: TrendForce og andre analytikere ser de udvidede HBM-tests som en beredskabsplan på grund af leverancepresset, mens Nvidia beskriver dem som almindelig produktplanlægning.
HBM4 skulle være udsolgt for hele 2026, mens den bredere DRAM-mangel ventes at fortsætte gennem 2027 . Det skaber både pris- og leverancepres for Nvidias næste platforme – fra Vera Rubin til Rubin Ultra og senere produkter.
Når HBM og SOCAMM tilsammen udgør omkring 29 procent af BOM’en i Vera Rubin NVL72-systemer, bliver hukommelsesprisen en direkte faktor i designet . Nvidia må dermed afveje maksimal ydeevne mod, hvor mange systemer virksomheden faktisk kan bygge til en acceptabel pris.
For at få adgang til nok hukommelse har Nvidia indgået aftaler i en skala, der understreger problemets størrelse. Nvidia og SK Group annoncerede et strategisk initiativ til en værdi af over 500 milliarder dollar, som blandt andet omfatter et langsigtet samarbejde med SK Hynix om HBM4 til Vera Rubin-generationen .
Få dage senere indgik Samsung Electronics og Broadcom et separat samarbejde til 200 milliarder dollar . Samlet svarer det til omkring 700 milliarder dollar i aftaler og planlagt forsyning – et tegn på, at adgangen til avanceret hukommelse nu er blevet en strategisk prioritet for hele AI-chipindustrien.
I stedet for at satse alt på én avanceret HBM4e-konfiguration ser Nvidia ud til at forberede et bredere produktsortiment med forskellige stakhøjder og hukommelsesstørrelser .
Det kan give Nvidia mulighed for fortsat at levere store mængder, selv hvis de mest avancerede 12-Hi HBM4e-stakke er svære at skaffe eller godkende. Hvis HBM4e ikke er klar i tilstrækkelige mængder, kan Rubin Ultra i stedet sendes med 8-Hi HBM4e eller HBM4. Det kan betyde lidt lavere ydeevne pr. chip, men til gengæld flere leverbare systemer.
Rapporterne peger på et reelt pres fra både priser og leverancer. Nvidia evaluerer angiveligt HBM-varianter med lavere kapacitet til Rubin Ultra, mens SOCAMM-kapaciteten i Vera Rubin NVL72 skulle være reduceret fra 192 GB til 96 GB pr. modul.
Nvidia afviser, at der er tale om tvungne nedgraderinger, og kalder ændringerne kundeorienterede produktvarianter. Men de enorme forsyningsaftaler og hukommelsens voksende andel af systemomkostningerne viser, at HBM-manglen spiller en væsentlig rolle.
Den endelige hukommelsesspecifikation for Rubin Ultra er endnu ikke offentliggjort. Retningen er dog tydelig: Den næste generation af AI-hardware bliver ikke kun afgjort af GPU’ernes beregningskraft, men også af hvor meget avanceret hukommelse Nvidia kan skaffe – og til hvilken pris.