Selon TrendForce et plusieurs analystes, Nvidia teste désormais des versions dotées de moins de mémoire pour son futur GPU Rubin Ultra. Le groupe aurait également réduit la mémoire système de sa plateforme Vera Rubin NVL72. Nvidia présente ces choix non pas comme des baisses de gamme imposées par les pénuries, mais comme une planification habituelle de produits et de références destinés à différents profils de clients.
La nuance est importante : le prix et la disponibilité de la HBM4 commencent à peser à un niveau stratégique sur la conception même des produits Nvidia.
À partir du troisième trimestre 2026, Nvidia a élargi l'évaluation de la configuration mémoire de Rubin Ultra, qui reposait initialement sur une architecture 12-Hi HBM4e. L'entreprise testerait désormais quatre possibilités en parallèle :
La décision finale n'a pas encore été prise . Le nombre « Hi » désigne ici le nombre de couches de mémoire empilées dans un bloc HBM : passer de 12 à 8 couches peut réduire la capacité disponible par composant, mais aussi faciliter l'approvisionnement.
Cette réévaluation serait liée à deux incertitudes. D'une part, la pénurie mondiale de DRAM attendue en 2027 pourrait limiter la capacité de production disponible pour la HBM. D'autre part, le calendrier de qualification de la HBM4e reste incertain chez les trois grands fabricants de mémoire .
Le cas de Vera Rubin est plus concret. Nvidia aurait décidé de réduire de moitié la capacité des modules SOCAMM utilisés par les processeurs Vera dans le système en rack Vera Rubin NVL72, en passant de 192 à 96 Go par module .
D'après les analyses relayées par TrendForce et GF Securities, la mémoire totale des CPU Vera par rack passerait ainsi d'environ 55 à 28 To. La mémoire HBM4 des GPU resterait, elle, inchangée à 20,7 To par rack .
L'objectif serait de réduire les coûts et de desserrer les contraintes d'approvisionnement. La mémoire représenterait déjà environ 29 % du coût total des composants — ou BOM, pour « bill of materials » — d'un système Vera Rubin . Elle n'est donc plus un simple composant d'accompagnement : elle devient l'un des principaux postes de dépenses de l'ensemble.
Certains éléments suggèrent que ces changements pourraient correspondre à plusieurs SKU spécifiques aux clients, avec des niveaux de mémoire différents selon les usages, plutôt qu'à une réduction uniforme des caractéristiques du produit phare .
Cette lecture rejoint la réponse officielle de Nvidia, mais ne dissipe pas entièrement les interrogations sur l'approvisionnement. Dans les deux cas, la flexibilité du catalogue devient un moyen de composer avec une mémoire coûteuse et difficile à obtenir.
Dans un article publié le 7 août 2026, Nvidia a rejeté l'idée que Vera ou Rubin aient été réduits en raison d'une pénurie de HBM. L'entreprise affirme que les configurations évoquées correspondent à des références différentes et à des réglages adaptés aux clients, et non à une rétrogradation imposée par les contraintes d'approvisionnement .
Nvidia précise également qu'elle ajuste régulièrement les capacités de calcul, le réseau et la mémoire afin d'optimiser les performances et l'efficacité pour chaque client .
Le PDG Jensen Huang s'est montré tout aussi rassurant sur la production. En juin 2026, il a confirmé que Samsung, SK Hynix et Micron — les trois principaux fabricants de mémoire concernés — étaient certifiés pour fournir de la HBM4. Il a aussi indiqué que Vera Rubin était en production complète, tandis que Rubin, Rubin Ultra et les serveurs Kyber restaient dans les temps .
En juillet 2026, Huang a par ailleurs rejeté les informations faisant état de retards, déclarant que la production de Vera Rubin avançait à des volumes « gigantesques » .
Le désaccord porte donc moins sur les changements eux-mêmes que sur leur interprétation. Pour TrendForce et d'autres analystes, l'élargissement des tests HBM ressemble à un plan de secours dicté par l'offre. Pour Nvidia, il s'agit d'une stratégie normale de déclinaison des produits en fonction des charges de travail.
La HBM4 serait déjà entièrement réservée pour 2026, tandis que la pénurie de DRAM devrait se poursuivre en 2027 . Cette situation crée une pression durable sur les prix et les volumes de toutes les plateformes Nvidia de nouvelle génération, de Vera Rubin à Rubin Ultra et aux produits qui suivront.
Dans les systèmes Vera Rubin NVL72, la mémoire — HBM et SOCAMM réunies — représenterait environ 29 % de la BOM totale . Cette proportion donne une idée de l'ampleur de l'arbitrage : modifier la capacité mémoire peut avoir un effet direct sur le prix, la disponibilité et le volume de systèmes que Nvidia est capable de livrer.
Pour sécuriser ses volumes, Nvidia cherche à réserver les capacités de production bien en amont. Nvidia et le groupe SK ont annoncé une initiative stratégique de plus de 500 milliards de dollars, comprenant un partenariat de long terme avec SK Hynix pour l'approvisionnement en HBM4 de la génération Vera Rubin .
Quelques jours plus tard, Samsung Electronics et Broadcom ont annoncé une collaboration distincte de 200 milliards de dollars . Ces annonces, qui représentent ensemble environ 700 milliards de dollars d'engagements, illustrent le poids stratégique pris par la sécurisation de la mémoire dans l'écosystème des puces d'IA.
Nvidia semble ainsi préparer une gamme plus large de SKU, avec différents nombres de couches HBM et différentes capacités mémoire . Cette approche lui permettrait de continuer à livrer des accélérateurs en volume même si les versions HBM4e les plus ambitieuses restent difficiles à qualifier ou à produire.
Si les composants 12-Hi HBM4e tardent à être disponibles, Rubin Ultra pourrait toujours être décliné avec de la HBM4e 8-Hi, voire de la HBM4 selon les variantes retenues. Le compromis serait potentiellement une performance moindre par puce, mais une capacité accrue à fournir les clients.
Les informations disponibles font état d'une pression réelle sur les coûts et l'approvisionnement. Nvidia évalue plusieurs configurations HBM moins capacitaires pour Rubin Ultra et aurait déjà réduit la mémoire SOCAMM du système Vera Rubin NVL72. L'entreprise nie toutefois toute rétrogradation forcée et parle de références différentes, ajustées aux besoins des clients.
La spécification finale de Rubin Ultra n'a pas encore été annoncée. Mais la tendance est claire : l'avenir du matériel d'IA ne se jouera pas uniquement sur la puissance de calcul des GPU. Il dépendra aussi de la quantité de mémoire disponible, de sa qualification et du prix à payer pour l'obtenir.