d-Matrix 正在选择一条无需客户另建一套独立加速器集群的路线,切入大规模 AI 推理市场。该公司宣布,将在下一代 Raptor 推理 XPU 中集成英伟达 NVLink Fusion,使其芯片能够接入英伟达 MGX 机架架构及更广泛的 AI 基础设施平台。双方将此定义为一项多年产品路线图,首批集成 Raptor XPU 的 MGX 机架预计于 2027 年第四季度提供。
1
8
这次合作真正改变了什么
NVLink Fusion 是英伟达面向定制 CPU 与 XPU 的高带宽、低延迟互连技术及 IP。对 d-Matrix 来说,这意味着 Raptor 不必只部署在专门定制的系统中,而能连接至 NVLink 纵向扩展(scale-up)网络、Spectrum-X 横向扩展(scale-out)网络及 MGX 机架设计。
1
14
规划中的机架将采用英伟达 Vera CPU、NVLink 交换机、BlueField-4 DPU、ConnectX-9 SuperNIC 和 Spectrum-X Ethernet。d-Matrix 表示,这将让其系统沿用已经验证的机架、网络、供电、散热和供应链方案,避免从头完成专用加速器厂商通常需要承担的整机集成工作。
1
8
因此,这不只是“把另一颗芯片插进服务器”。更关键的是系统级集成:数据中心运营方可在同一套以英伟达为核心的基础设施方法下部署 GPU、CPU 与 d-Matrix XPU,而不必针对每种处理器分别设计专用机架。
1
Raptor 如何与英伟达 GPU 分工
拟议架构采用“解耦式推理”。其中,英伟达 GPU 处理计算密集的 **prefill(预填充)**阶段;d-Matrix 的专用硬件则面向逐 token 生成的 **decode(解码)**阶段。
简单说,预填充负责处理用户输入的提示词;解码则负责持续输出后续文本 token。这样的分工意在让不同处理器处理各自更适合的推理环节。
d-Matrix 此前已表示,推理云服务商 Parasail 将把现有 Corsair 加速器与英伟达 Hopper、Blackwell 系统配合部署,采用大致相同的“GPU 预填充 + 专用芯片解码”方式。
22
不过,性能收益会随模型、请求长度、并发量及软件栈而变化。Parasail 所称“最高快 10 倍、成本效益更高”,是公司及合作伙伴针对特定工作负载的说法,并不是经独立验证、适用于所有场景的 d-Matrix 与 GPU 通用对比结论。
22
机架规划与时间表
d-Matrix 表示,其首个 Raptor 机架将遵循英伟达 MGX 参考架构。相关报道描述了一种 NVL144 风格的设计,目标是在单一 NVLink Fabric 中连接最多 144 枚 Raptor 加速器;但这些参数仍属未来规划,并非已出货产品的承诺。
2
目前较明确的节点是:集成进英伟达 MGX 机架的首批 Raptor XPU,预计于 2027 年第四季度提供。
8
在 Raptor 成为实际出货的 MGX 产品前,客户应把性能、容量和部署细节视为路线图目标,等待最终系统及可独立复现的测试结果。
英伟达为何愿意接纳第三方加速器
乍看之下,让第三方推理处理器接入平台,似乎会削弱英伟达 GPU 的地位。但其战略逻辑恰恰相反:即使计算芯片不是英伟达 GPU,英伟达仍可让自己的 AI 平台成为部署基础。
NVLink Fusion 让高价值的平台层——包括纵向扩展互连、网络、机架架构及配套基础设施——留在英伟达生态内。对 d-Matrix 及其客户,这可能降低集成风险、缩短部署周期;对英伟达,则降低客户另行建设一套完全脱离英伟达体系集群的必要性。
1
14
这也是英伟达所称平台“纵向整合、横向开放”的含义:
- 纵向整合:英伟达协调计算互连、网络、机架设计及更广泛 AI 平台等多个基础设施层。
- 横向开放:定制 CPU 和 XPU 厂商可通过 NVLink Fusion,将自家芯片接入该平台。
1
14
这并不表示所有加速器都能互换,或性能完全等价。所谓“可替代性”,更适合理解为一种运维目标:运营方可以为不同工作负载选择合适的计算资源,同时沿用共同的基础设施底座。
与英伟达 Groq 3 的关系:合作也是潜在竞争
d-Matrix 的方案在“GPU 预填充、XPU 解码”的设计中与英伟达 GPU 互补;但在专用推理硬件市场,它也与英伟达计划推出的 Groq 3 LPU 系统处在相近赛道。英伟达将 Groq 3 LPX 定位为面向解码环节的专用方案,可与 Vera Rubin NVL72 基础设施配合。
24
由此形成双重关系:Raptor 可以补充英伟达 GPU,并使用英伟达的平台基础设施;同时,它也可能与英伟达自身的专用解码方案竞争。现有公开资料不足以对双方在延迟、吞吐量、功耗、价格或供货能力上作出有意义的正面对比。
d-Matrix 的融资与 Corsair 背景
d-Matrix 称,其在 2025 年 11 月完成的 C 轮融资规模为 2.75 亿美元,公司估值为 20 亿美元,累计融资达到 4.5 亿美元。
27
Corsair 是 d-Matrix 当前的推理平台;Raptor 则是此次 NVLink Fusion 路线图中提到的下一代 XPU。Corsair 已成为 d-Matrix 与 Parasail 合作的基础,后者称将把该加速器与英伟达基础设施共同用于部分推理工作负载。
22
Raptor 的意义在于,d-Matrix 正在规划一条更直接进入英伟达机架级环境的路径。
仍未披露的部分
双方没有披露交易的财务条款。因此,公开信息无法确认是否存在授权费、最低采购承诺、工程服务费、收入分成或其他优先商业条件。
总体而言,这项宣布更应被看作一项重要的基础设施路线图:d-Matrix 获得了把专用解码硬件部署进英伟达 AI 工厂的路径;英伟达则扩大了可依赖其互连与机架生态的计算芯片范围。它能否转化为更优的实际推理经济性,仍取决于最终硬件、软件集成、定价,以及可独立复现的工作负载测试结果。
1
8