d Matrix planea conectar sus XPUs Raptor de próxima generación a la infraestructura de IA de Nvidia mediante NVLink Fusion y racks basados en MGX. La propuesta combina el prefill en GPU de Nvidia con la fase de decodificación token a token en hardware especializado de d Matrix.
Publicado porEditado con GPT-5.6 TerraImágenes generadas con GPT Image 2
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix quiere que sus próximos aceleradores de inferencia Raptor se desplieguen dentro de la infraestructura de IA de Nvidia, sin que los clientes tengan que construir un clúster independiente para ese silicio. La compañía anunció que integrará NVLink Fusion de Nvidia en sus XPUs Raptor, conectándolos con la arquitectura de racks MGX y el ecosistema más amplio de Nvidia. Ambas empresas describen el acuerdo como una hoja de ruta de producto plurianual; la disponibilidad inicial de Raptor integrado en racks MGX se espera para el cuarto trimestre de 2027. 1
8
NVLink Fusion es la tecnología y propiedad intelectual de Nvidia para interconectar, con gran ancho de banda y baja latencia, CPU y XPU personalizados dentro de su plataforma de infraestructura de IA. Para d-Matrix, esto supone que Raptor podrá conectarse a la red de escalado vertical NVLink, la red de escalado horizontal Spectrum-X y los diseños de rack MGX, en lugar de limitarse a sistemas diseñados a medida. 1
14
El diseño previsto del rack incorpora CPU Nvidia Vera, switches NVLink, DPU BlueField-4, SuperNIC ConnectX-9 y Ethernet Spectrum-X. Según d-Matrix, esta integración le proporciona una vía validada para el trabajo de rack, red, alimentación eléctrica, refrigeración y cadena de suministro que otros fabricantes de aceleradores personalizados tendrían que resolver por su cuenta. 1
8
En la práctica, el anuncio trata de integración de sistemas, no solo de añadir otro chip a un servidor. Un operador de centro de datos podría utilizar una base de infraestructura orientada a Nvidia para GPU, CPU y XPU, en vez de diseñar racks dedicados para cada tipo de procesador. 1
La arquitectura propuesta utiliza inferencia desagregada. Las GPU de Nvidia asumen el prefill, la fase de mayor carga de cómputo; el hardware especializado de d-Matrix se orienta a la decodificación, que genera los tokens de salida uno a uno. El prefill procesa el prompt de entrada, mientras que la decodificación construye la respuesta sucesiva del modelo.
La idea es asignar a cada procesador la etapa para la que está diseñado. d-Matrix ya había señalado que Parasail desplegaría sus aceleradores Corsair actuales junto con sistemas Nvidia Hopper y Blackwell con este enfoque general de prefill y decodificación. 22
Conviene matizar que las posibles mejoras dependen de cada carga de trabajo. La afirmación de Parasail de servicios hasta 10 veces más rápidos y rentables es una declaración de las compañías para cargas seleccionadas, no una comparación universal e independiente entre el hardware de d-Matrix y las GPU. 22
d-Matrix ha indicado que su primer rack Raptor seguirá la arquitectura de referencia MGX de Nvidia. La información sobre la hoja de ruta describe un diseño de estilo NVL144, pensado para conectar hasta 144 aceleradores Raptor en una sola red NVLink; estas especificaciones son planes futuros, no garantías de un producto ya comercializado. 2
El hito concreto comunicado por d-Matrix es más acotado: la disponibilidad inicial de XPUs Raptor integrados en un rack Nvidia MGX se espera en el cuarto trimestre de 2027. 8
Como Raptor todavía no es un producto MGX disponible, los clientes deberían considerar el rendimiento, la capacidad y los detalles de despliegue como objetivos de hoja de ruta hasta que existan sistemas definitivos y pruebas reproducibles e independientes.
A primera vista, facilitar la entrada de un procesador de inferencia de terceros podría parecer una cesión de terreno por parte de Nvidia. La lógica estratégica es la contraria: Nvidia busca que su plataforma sea la base preferida incluso cuando el chip de cómputo no sea una GPU de Nvidia.
NVLink Fusion mantiene dentro del ecosistema de Nvidia capas de alto valor como la interconexión de escalado vertical, las redes, la arquitectura de rack y la infraestructura asociada. Para d-Matrix y sus clientes, esto puede reducir el riesgo de integración y acelerar el despliegue. Para Nvidia, disminuye la necesidad de levantar un clúster completamente ajeno a su plataforma. 1
14
Ese es el sentido de la descripción de Nvidia de una plataforma «integrada verticalmente y abierta horizontalmente».
Esto no significa que todos los aceleradores sean intercambiables ni equivalentes en rendimiento. La idea de recursos «fungibles» debe entenderse como un objetivo operativo: elegir el recurso de cómputo adecuado para cada carga de trabajo conservando una infraestructura común.
El plan de d-Matrix es complementario a las GPU de Nvidia en el reparto propuesto entre prefill y decodificación, pero también entra en el mismo territorio de inferencia especializada que los sistemas Groq 3 basados en LPU que Nvidia prepara. Nvidia ha presentado Groq 3 LPX como una solución de decodificación diseñada específicamente para esa tarea y capaz de emparejarse con infraestructura Vera Rubin NVL72. 24
De ahí surge una relación dual: Raptor podría complementar a las GPU y usar la infraestructura de Nvidia, al tiempo que competiría potencialmente con la propuesta especializada de decodificación de la propia Nvidia. La información disponible no permite una comparación concluyente de latencia, rendimiento, consumo energético, precio o disponibilidad.
d-Matrix informó de una ronda Serie C de 275 millones de dólares en noviembre de 2025, con una valoración de 2.000 millones de dólares. Con ella, la financiación total de la empresa ascendió a 450 millones de dólares. 27 Su plataforma de inferencia actual es Corsair; Raptor es la XPU de próxima generación incluida en la hoja de ruta de NVLink Fusion.
Corsair ya es la base de la alianza de d-Matrix con Parasail, que afirmó que desplegaría esos aceleradores junto a infraestructura Nvidia para determinadas cargas de inferencia. 22 La relevancia de Raptor es que d-Matrix planea ahora una entrada más directa en el entorno de racks a escala de Nvidia.
Ninguna de las dos empresas ha revelado los términos financieros del acuerdo. Por tanto, la información pública no establece regalías de licencia, compromisos mínimos de compra, tarifas de ingeniería, reparto de ingresos ni condiciones comerciales preferentes.
El anuncio debe leerse, por ahora, como una hoja de ruta relevante de infraestructura: d-Matrix obtiene una vía para desplegar hardware especializado en decodificación dentro de fábricas de IA basadas en Nvidia, mientras que Nvidia amplía el abanico de chips de cómputo que pueden apoyarse en su ecosistema de interconexión y racks. Que eso se traduzca en una mejor economía real de inferencia dependerá del hardware final, la integración de software, los precios y los resultados reproducibles en cargas de trabajo. 1
8
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
d Matrix planea conectar sus XPUs Raptor de próxima generación a la infraestructura de IA de Nvidia mediante NVLink Fusion y racks basados en MGX.
d Matrix planea conectar sus XPUs Raptor de próxima generación a la infraestructura de IA de Nvidia mediante NVLink Fusion y racks basados en MGX. La propuesta combina el prefill en GPU de Nvidia con la fase de decodificación token a token en hardware especializado de d Matrix.
La primera disponibilidad de XPUs Raptor integrados en un rack Nvidia MGX está prevista para el cuarto trimestre de 2027.