2026年第3四半期以降、NvidiaはRubin UltraのHBM構成の評価範囲を、当初計画の単一の12-Hi HBM4eベースラインから拡大した。TrendForceによると、同社は現在4つの代替案を並行してテストしている。
最終仕様は未確定である。この変更は、2027年に予想される業界全体のDRAM不足によりHBM生産に使用可能なウェハー容量が制約される可能性や、3大メモリメーカーにおけるHBM4eの認定スケジュールに対する不確実性が続いていることを受けた直接的な対応だ。
Vera Rubinプラットフォームでは、より具体的な変更が報告されている。NvidiaはVera Rubin NVL72ラックスケールシステムにおいて、SOCAMMメモリ容量を半減し、モジュールあたり192GBから96GBに削減する決定を下した。TrendForceやGF Securitiesの分析によれば、ラックあたりの総Vera CPUメモリは約55TBから28TBに減少する一方、GPU HBM4容量はラックあたり20.7TBで変わらない。この措置はコスト削減と供給制約の緩和を目的としており、Vera Rubinプラットフォームではメモリコストがシステム全体の部品表(BOM)の推定**29%**に達している。
一部の情報源は、メモリ削減に見える動きは、単一のフラッグシップ仕様を削減するのではなく、異なるワークロードに応じた顧客別SKUをNvidiaがテストしている可能性を指摘している。この解釈はNvidiaの公式見解と整合する。
Nvidiaは、VeraやRubinがHBM不足によって削減されたという見方を公式に否定している。2026年8月7日のブログ投稿で、Nvidiaは憶測を退け、問題の構成は異なるSKUと顧客別のチューニングであり、供給制約によるダウングレードではないと述べた。同社はまた、顧客に最高のパフォーマンスと効率を提供するために、コンピュート、ネットワーキング、メモリを継続的に調整していると付け加えた。
CEOのジェンスン・フアン(Jensen Huang)はより直接的な発言をしている。2026年6月、彼は3大メモリメーカー(サムスン、SKハイニックス、マイクロン)がすべてHBM4供給の認定を受けており、Vera Rubinはフル生産に入り、Rubin、Rubin Ultra、Kyberサーバーも計画通りであると確認した。2026年7月には、遅延の報告を退け、Vera Rubinの生産は「巨大な」数量で進んでいると述べた。
核心的な緊張関係は明らかだ。TrendForceなどのアナリストは、HBM評価の拡大を供給主導の緊急時対応計画と解釈する一方、Nvidiaはそれを異なる顧客ワークロードのための通常の製品バリエーション計画と位置づけている。
HBM4は2026年全体で完売しており、DRAM不足は2027年まで続くと予想されている。これは、Vera RubinからRubin Ultra、そしてそれ以降に至るまで、あらゆる次世代Nvidiaプラットフォームに構造的な価格と入手可能性の逆風をもたらしている。
メモリコストはシステム全体のコストに占める割合が大幅に増加している。Vera Rubin NVL72システムではシステムBOMの約**29%**を占め、メモリ(HBM + SOCAMM)はもはや単なる補助コンポーネントではなく、設計上のトレードオフを強いる主要なコストドライバーとなっている。
十分な供給を確保するため、Nvidiaは前例のない規模で生産能力を確保する動きに出ている。NvidiaとSKグループは、Vera Rubin世代向けのSKハイニックスとのHBM4長期供給契約を含む、5,000億ドル超の戦略的イニシアチブを発表した。その数日後、サムスン電子とブロードコムは別途2,000億ドルの協業を発表した。これらの契約は合計で約7,000億ドルの供給確約となり、AIチップエコシステム全体にとって、十分なメモリを許容可能なコストで確保することが、数百億ドル規模の戦略的優先事項であることを示している。
Nvidiaは単一のフラッグシップHBM4e構成にすべてを賭けるのではなく、HBMスタックの高さやメモリサイズを変えたより広範なSKUを準備しているようだ。これにより、最高級のHBM4eスタックが不足している場合でも、同社は量産出荷を継続できる。12-Hi HBM4e部品の認定が遅れた場合でも、Nvidiaは8-Hi HBM4eやHBM4部品を搭載したRubin Ultraを出荷できるため、チップあたりのパフォーマンスが多少低下しても顧客への供給を維持できる。
これらの報告は、実際の供給とコストの圧力がNvidiaに低容量HBMバリアントの評価を促し、Vera RubinシステムではすでにSOCAMMを削減したことを示している。Nvidiaは公式には強制的なダウングレードを否定し、これらのバリエーションを不足への反応ではなく顧客別のチューニングと呼んでいる。しかし、記録的な供給契約とメモリのシステムコストに占める割合の上昇は、HBMの制約がRubin時代の製品ラインナップを形成する主要な要因であることを明確に示している。Rubin Ultraの最終的なメモリ仕様はまだ発表されていないが、方向性は明白だ。次世代AIハードウェアは、GPUのパフォーマンスだけでなく、それを支えるメモリの入手可能性とコストによって定義されることになる。