d-Matrix 正準備以一條不必另建獨立加速器叢集的路線,切入大規模 AI 推論市場。該公司宣布,下一代 Raptor 推論 XPU 將整合 NVIDIA 的 NVLink Fusion,接入 NVIDIA 的 MGX 機架架構與更廣泛的 AI 基礎設施平台。雙方將此定位為多年產品路線圖,首批整合至 MGX 機架的 Raptor XPU 預計於 2027 年第 4 季供應。
1
8
重點不只是「插上一顆晶片」,而是整合整套機架
NVLink Fusion 是 NVIDIA 提供給客製 CPU 與 XPU 的高頻寬、低延遲互連技術及 IP。對 d-Matrix 而言,Raptor 未來可連接 NVLink 的 scale-up(縱向擴展)網路、Spectrum-X 的 scale-out(橫向擴展)網路,並納入 MGX 機架設計;不必只能部署在自行打造的專屬系統中。
1
14
規劃中的機架將採用 NVIDIA Vera CPU、NVLink 交換器、BlueField-4 DPU、ConnectX-9 SuperNIC 與 Spectrum-X Ethernet。d-Matrix 表示,這讓其系統能沿用機架、網路、供電、冷卻與供應鏈的既有驗證路徑;這些原本都是客製加速器廠商得自行整合的環節。
1
8
換句話說,這次合作的核心是系統級整合。資料中心營運商未來可在同一套 NVIDIA 導向的基礎設施框架下部署 GPU、CPU 與 d-Matrix XPU,而不必為每一類處理器各自設計專用機架。
1
Raptor 與 NVIDIA GPU 如何分工?
雙方主張的架構是「解耦式推論」(disaggregated inference):NVIDIA GPU 負責運算量較大的 prefill 階段,d-Matrix 的專用硬體則瞄準逐 token 產生結果的 decode 階段。簡單說,prefill 是讀取並處理使用者輸入的提示內容;decode 則是模型一個 token 接一個 token 輸出回答。
這種分工的目的,是讓不同處理器各自處理較適合的工作。d-Matrix 先前曾表示,推論雲端服務商 Parasail 將以相同的大方向,把目前的 Corsair 加速器與 NVIDIA Hopper、Blackwell 系統並用。
22
不過,效益仍高度取決於工作負載。Parasail 所稱「最高快 10 倍、成本效益更佳」的服務,屬於公司與合作夥伴針對特定工作負載的說法,不能視為 d-Matrix 硬體相較 GPU 在所有情境下都已獲獨立驗證的普遍結論。
22
機架規格與時程:哪些已確定、哪些仍是藍圖?
d-Matrix 表示,首個 Raptor 機架將遵循 NVIDIA MGX 參考架構。相關報導提到,路線圖中的 NVL144 類型設計,目標是在單一 NVLink fabric 內連接最多 144 顆 Raptor 加速器;但這些仍是未來規劃,並非已出貨產品的保證規格。
2
目前較明確的供應里程碑是:整合至 NVIDIA MGX 機架的首批 Raptor XPU,預計在 2027 年第 4 季推出。
8
因此,在最終硬體、軟體整合方案與可獨立測試的效能數據出現前,客戶應將 Raptor 的效能、容量與部署細節視為路線圖目標,而非既成事實。
為何 NVIDIA 會擁抱第三方加速器?
表面看來,讓第三方推論處理器進入其系統,似乎可能稀釋 NVIDIA 的角色;但其策略邏輯剛好相反:即使運算晶片不是 NVIDIA GPU,NVIDIA 仍希望自家 AI 平台成為部署的首選底座。
NVLink Fusion 讓關鍵的平台層——包括 scale-up fabric、網路、機架架構及相關基礎設施——仍留在 NVIDIA 生態內。對 d-Matrix 及其客戶,這可能降低整合風險、加速部署;對 NVIDIA 而言,則降低客戶另建完全非 NVIDIA 叢集的必要性。
1
14
這也是 NVIDIA 將平台形容為「垂直整合、水平開放」的含義:
- 垂直整合:NVIDIA 協調運算互連、網路、機架設計與整體 AI 平台等多個基礎設施層。
- 水平開放:客製 CPU 與 XPU 業者可透過 NVLink Fusion,把自己的晶片接入這個平台。
1
14
這不代表所有加速器都能直接互換,或具有相同效能。若以「可替換」理解,較精確的意思是營運層面的目標:營運商能依工作負載選用合適的運算資源,同時共用一套基礎設施底座。
與 NVIDIA 自家 Groq 3 的關係:互補,也可能競爭
Raptor 在 prefill/decode 分工中可與 NVIDIA GPU 互補,但在專用推論硬體領域,也與 NVIDIA 規劃的 Groq 3 LPU 系統處於相近賽道。NVIDIA 已將 Groq 3 LPX 描述為可與 Vera Rubin NVL72 基礎設施搭配的專用 decode 解決方案。
24
因此,這是一種雙重關係:Raptor 能與 NVIDIA GPU 協作並使用 NVIDIA 平台基礎設施,同時也可能與 NVIDIA 自家的專用 decode 方案競爭。目前公開資訊仍不足以對兩者的延遲、吞吐量、耗電、價格或供應時程作出有意義的正面比較。
d-Matrix 的資金、Corsair 與 Parasail 合作背景
d-Matrix 表示,其 2025 年 11 月的 C 輪融資募得 2.75 億美元,公司估值為 20 億美元,累計募資達 4.5 億美元。
27 該公司目前的推論平台為 Corsair;Raptor 則是 NVLink Fusion 路線圖中的下一代 XPU。
Corsair 已是 d-Matrix 與 Parasail 合作的基礎。Parasail 表示,將在特定推論工作負載中,把 Corsair 與 NVIDIA 基礎設施並用。
22 Raptor 的意義在於,d-Matrix 現在正規劃更直接地進入 NVIDIA 的機架級部署環境。
尚未公開的部分
雙方沒有披露協議的財務條款。因此,公開資訊無法確認是否涉及授權權利金、最低採購承諾、工程費用、營收分成,或任何優先商業條件。
整體而言,這是一項重要的基礎設施路線圖:d-Matrix 可望取得一條將專用 decode 硬體部署於 NVIDIA AI 工廠的途徑;NVIDIA 則擴大可依賴其互連與機架生態的運算晶片範圍。這是否會帶來更好的實際推論經濟效益,仍有待最終硬體、軟體整合、定價與可重現的獨立工作負載測試結果來驗證。
1
8