Vera Rubin 並非單一伺服器,而是一個完整的 POD 級超級電腦,將五種功能各異的機櫃整合為單一系統 。完整的產品線包括:
這種模組化設計,讓每個機櫃能針對訓練、推論、網路或儲存等特定功能進行最佳化,同時又能作為單一邏輯超級電腦協同運作。
Vera Rubin 的量產規模極為龐大。Nvidia 證實,全球有數百家供應鏈合作夥伴正在製造相關系統,其中超過 150 家位於台灣 。生產網絡橫跨 30 個國家、超過 350 座工廠,這明確顯示 Nvidia 正為滿足 AI 實驗室、雲端服務商和超大規模業者的龐大需求,做好大規模出貨的準備 。目前投入全面量產的一線系統製造商包括 Dell Technologies、HPE、Lenovo 與 Supermicro 等 。台灣作為全球 AI 供應鏈的核心樞紐,在這次技術升級中扮演了無可取代的角色。
在 GTC 台北主題演講後不到一天,CoreWeave 便宣布已在 CoreWeave Cloud 上完成 Vera Rubin NVL72 系統的業界首次開機與驗證 。該公告指出,相較於前代產品,新機櫃的每瓦推論效能提升達 10 倍,同時大幅減少了執行大規模工作負載所需的 GPU 數量 。CoreWeave 能以如此驚人的速度建立並運行完整系統,不僅凸顯其與 Nvidia 深厚的工程合作關係,也使其成為 Vera Rubin 世代最領先的早期採用雲端供應商。
Vera CPU 是該平台的一大亮點。作為 Nvidia 首款獨立資料中心 CPU,它已正式進入量產,預計於 2026 年下半年開始出貨 。Nvidia 專為自主 AI 代理的需求設計此晶片,需在海量記憶體池中進行高吞吐量、低延遲的處理。目前已確認的首批客戶包括 OpenAI、Anthropic 和 SpaceX ,足見市場對其效能的期待。
Vera Rubin 進入全面量產,象徵著產業正從單純的生成式 AI,轉向專為代理式 AI 打造的新型基礎設施。這類系統不僅能生成回應,更能進行推理、規劃並執行多步驟的複雜任務。Nvidia 將 Groq 的低延遲推論技術直接整合進 POD 架構中,正是著眼於推論速度與效率至關重要的新興工作負載 。
該平台預計在 2026 年下半年正式向雲端服務商與企業客戶出貨。目前,AWS、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 都已被列為預期的早期部署夥伴 。從年初 CES 首度宣布投產,到 3 月 GTC 大會再次強調,再到這次 GTC 台北的更新,Vera Rubin 的量產動能絲毫未減,如今更有著全面啟動的全球供應鏈作為堅實後盾 。