Vera Rubin平台並非單一伺服器,而係一套完整嘅POD級(Point of Delivery,即交付點級別,泛指超大規模整合系統)超級電腦,將五種功能各異嘅機櫃結合成一個整合系統 。成個陣容包括:
呢種模組化設計令每個機櫃可以針對特定功能(訓練、推理、網路或儲存)進行最佳化,同時作為單一邏輯超級電腦運作。
呢次量產規模遍及全球。Nvidia確認有數以百計嘅供應鏈生態系統夥伴正在製造Vera Rubin系統,單係台灣就有超過150間合作夥伴參與其中 。生產線橫跨全球30個國家、超過350間工廠,呢個規模清楚顯示Nvidia正準備應付來自AI實驗室、雲端服務商同超大規模數據中心嘅龐大需求 。已全面投產嘅頂級系統製造商包括Dell Technologies、HPE、Lenovo同Supermicro 。
喺台北GTC主題演講後唔夠一日,CoreWeave就宣布佢哋已經喺CoreWeave Cloud上完成咗業界首個Vera Rubin NVL72系統嘅啟用同驗證 。CoreWeave確認,呢個機櫃嘅每瓦特推理效能比上一代高出最多10倍,同時大幅減少大規模工作負載所需嘅GPU數量 。CoreWeave咁快就可以令一套完全運作嘅系統上線,充分證明咗佢同Nvidia之間深厚嘅工程合作關係,亦令佢成為Rubin世代嘅領先早期存取服務供應商。
Vera CPU係呢個平台嘅關鍵差異化武器。佢被形容為Nvidia首款獨立嘅數據中心CPU,現已進入大規模量產,預計2026年下半年開始出貨 。Nvidia專門為自主AI代理嘅需求設計呢粒晶片,呢類代理需要喺龐大嘅記憶體池中進行高吞吐量、低延遲嘅處理。已確認嘅早期客戶包括OpenAI、Anthropic同SpaceX 。
Vera Rubin轉向全面量產,標誌住成個業界正轉向為代理式AI建設專用基礎設施——呢類系統唔單止識得生成回應,仲識得推理、規劃同執行多步驟操作。Nvidia將Groq嘅低延遲推理技術直接整合到POD架構入面,正正係瞄準咗一類講求推理速度同效率嘅全新工作負載 。
個平台預計喺2026年下半年正式向雲端服務商同企業供貨,AWS、Google Cloud、Microsoft Azure同Oracle Cloud Infrastructure都被點名為預期嘅早期部署者 。鑑於Vera Rubin喺1月CES同3月GTC大會上都宣布過進入量產,今次GTC台北嘅更新就確認咗呢股量產勢頭有增無減,而且背後有一個已經全面擴展嘅全球供應鏈做支撐 。