由 2026 年第三季開始,Nvidia 擴展咗 Rubin Ultra 嘅 HBM 配置評估,由原本單一嘅 12-Hi HBM4e 基準,變成而家四種方案一齊測試 :
最終規格仲未定 。呢個轉變係直接回應 2027 年 DRAM 短缺嘅預期,同埋三大記憶體廠商(三星、SK 海力士、美光)喺 HBM4e 認證時間上嘅不確定性 。
Vera Rubin 平台方面,改動更具體。Nvidia 據報決定將 Vera Rubin NVL72 機架系統嘅 SOCAMM 記憶體容量減半,由 192GB 降至 96GB 每模組 。根據 TrendForce 同 GF Securities 分析,每機櫃 Vera CPU 總記憶體會由約 55TB 降至 28TB,而 GPU HBM4 容量就維持 20.7TB 不變 。咁做係為咗降低成本同紓緩供應壓力,因為記憶體成本已經佔咗 Vera Rubin 平台總系統物料清單(BOM)大約 29% 。
有啲分析認為,所謂「縮水」可能係 Nvidia 測試緊多個客戶專用 SKU,即係針對唔同工作負載提供不同記憶體級別,而唔係單純削減單一旗艦規格 。呢個講法同 Nvidia 官方立場一致。
Nvidia 公開否認 Vera 或 Rubin 係因為 HBM 短缺而降級。喺 2026 年 8 月 7 日嘅網誌入面,Nvidia 澄清相關配置係 不同 SKU 同客戶專用調整,唔係因為供應問題而被迫降級 。公司亦話會持續調整運算、網絡同記憶體組合,為客戶提供最佳性能同效率 。
CEO 黃仁勳(Jensen Huang)更加直接。2026 年 6 月,佢確認三大記憶體廠商(三星、SK 海力士、美光)都已通過 HBM4 供應認證,Vera Rubin 全面投產,Rubin、Rubin Ultra 同 Kyber 伺服器亦 按計劃進行 。2026 年 7 月,黃仁勳更否認延遲傳聞,話 Vera Rubin 產量「巨大」 。
核心矛盾好明顯:TrendForce 等分析機構將擴展 HBM 評估解讀為供應驅動嘅應變計劃;Nvidia 就話呢啲只係針對不同客戶工作負載嘅正常產品變體規劃。
高頻寬記憶體 4(HBM4)2026 年全年已賣斷市,DRAM 短缺預計持續到 2027 年 。呢個結構性嘅定價同供應問題,將會影響 Nvidia 由 Vera Rubin 到 Rubin Ultra 以至之後嘅每一代平台。
記憶體成本已經成為系統成本嘅主要部分。以 Vera Rubin NVL72 系統為例,記憶體(HBM + SOCAMM)佔咗總系統 BOM 大約 29%,令記憶體唔再只係輔助部件,而係要迫住做設計取捨嘅主要成本驅動因素 。
為確保足夠供應,Nvidia 用前所未有嘅規模鎖定產能。Nvidia 同 SK 集團宣布咗一個價值 超過 5000 億美元 嘅戰略合作,包括同 SK 海力士長期 HBM4 供應協議,涵蓋 Vera Rubin 世代 。幾日後,三星電子同 Broadcom 亦達成 2000 億美元 嘅獨立合作 。呢啲協議加起來約 7000 億美元,顯示以可接受成本確保足夠記憶體,已經成為整個 AI 晶片生態系統嘅數千億美元級戰略優先事項。
Nvidia 似乎唔再孤注一擲喺單一旗艦 HBM4e 配置,而係準備 更廣泛嘅 SKU 組合——透過改變 HBM 堆疊層數同記憶體大小——嚟應對不同價格點同供應情況 。咁樣就算最高階嘅 12-Hi HBM4e 供貨短缺,Nvidia 仍然可以用 8-Hi HBM4e 或 HBM4 部件繼續大量出貨,即使每粒晶片性能略低,但客戶仍然有貨用。
報告顯示,供應同成本壓力確實令 Nvidia 要評估容量較低嘅 HBM 變體,並且已經削減咗 Vera Rubin 系統嘅 SOCAMM 容量。Nvidia 官方否認係被迫降級,話呢啲只係客戶專用調整,唔係短缺反應。不過,破紀錄嘅供應協議同記憶體佔系統成本比例持續上升,都清楚顯示 HBM 限制係 Rubin 時代產品線嘅主要影響因素。Rubin Ultra 最終記憶體規格仲未公布,但方向好明確:下一代 AI 硬件唔單止由 GPU 性能定義,更加由餵飽佢哋嘅記憶體供應同成本所決定。