d Matrix wil zijn volgende generatie Raptor inference XPU’s via NVIDIA NVLink Fusion verbinden met de MGX rackarchitectuur; eerste beschikbaarheid is gepland voor het vierde kwartaal van 2027. Het beoogde MGX ontwerp omvat NVIDIA Vera CPU’s, NVLink switches, BlueField 4 DPU’s, ConnectX 9 SuperNICs en Spectrum X Ethe...
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion technology into its next-generation Raptor inference pro. Article summary: d-Matrix announced a multiyear roadmap partnership to design its next-generation Raptor inference XPUs for NVIDIA NVLink Fusion, beginning with integration into NVIDIA’s MGX rack reference architecture. The aim is a rack. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix wil zijn toekomstige Raptor-XPU’s voor AI-inferentie integreren in NVIDIA’s rackinfrastructuur via NVLink Fusion. De eerste geplande uitvoering is een op Raptor gebaseerd systeem volgens NVIDIA’s MGX-referentiearchitectuur, bedoeld voor grootschalige AI-inferentie met zeer lage vertraging. De eerste beschikbaarheid van Raptor in een MGX-rack wordt voorzien in het vierde kwartaal van 2027. 1
2
11
NVLink Fusion is NVIDIA’s platform waarmee externe CPU’s en versnellers kunnen worden aangesloten op het NVLink-netwerk voor opschalen binnen een systeem en op de bredere AI-infrastructuur. d-Matrix wil Raptor via NVLink koppelen en Spectrum-X Ethernet inzetten voor opschalen tussen systemen. 1
Daarmee kan d-Matrix zijn eigen inference-silicium onderbrengen in een bestaand NVIDIA-rackontwerp, in plaats van zelf een afzonderlijk platform voor racks, netwerken en koeling te moeten ontwikkelen en kwalificeren. NVIDIA en d-Matrix presenteren dit als een snellere aanpak met minder integratierisico richting grootschalige uitrol. 1
2
Volgens d-Matrix krijgt het geplande Raptor-systeem de nieuwste MGX-referentiearchitectuur van NVIDIA, met onder meer:
MGX is een modulaire rackarchitectuur. NVIDIA stelt dat de integratie Raptor onderbrengt in een breed toepasbare, vloeistofgekoelde AI-infrastructuur. 1
De aankondiging bevestigt compatibiliteit met NVIDIA’s infrastructuur op rackschaal, maar de aangehaalde bedrijfsmededelingen leggen geen definitieve, leverbare Raptor-configuratie vast die specifiek als een „NVL144”-systeem wordt verkocht. Cijfers over aantallen versnellers of geheugenbandbreedte die vóór de marktintroductie circuleren, moeten daarom als roadmapprojecties worden gezien, niet als geïnstalleerde of onafhankelijk geteste specificaties.
De samenwerking draait om heterogene inferentie: verschillende soorten processors voeren verschillende delen uit van het verwerken van een generatief AI-model.
Een gebruikelijke taakverdeling is dat GPU’s de prefill uitvoeren: de rekenintensieve fase waarin een model de invoerprompt verwerkt. Een gespecialiseerde versneller behandelt vervolgens de decode: de fase waarin het model token voor token tekst genereert en waarin lage vertraging cruciaal is. d-Matrix positioneert Raptor voor die decode-rol. 18
19
Raptor volgt op het Corsair-platform van d-Matrix, dat al in productie is, en bouwt voort op de geheugen-gerichte architectuur van het bedrijf. Volgens d-Matrix brengt Raptor via een 3D-DRAM-stapeltechniek een DRAM-geheugendie en een SRAM-computedie samen in één package. Het uitgangspunt is dat de nauwere koppeling tussen geheugen en rekenkracht beter aansluit bij inferencewerk met lage vertraging. 2
Raptor wordt dus niet gepresenteerd als een volledige vervanger van GPU’s. Het moet een gespecialiseerd onderdeel worden in een inferencecluster op basis van NVIDIA, waarin elke processor werk uitvoert dat bij zijn architectuur past.
Voor NVIDIA vergroot ondersteuning voor een externe XPU via NVLink Fusion de verscheidenheid aan hardware die kan werken binnen zijn netwerk-, rack- en infrastructuurecosysteem. Voor klanten zit de directe aantrekkingskracht in de integratie: een gespecialiseerde inferenceversneller kan worden ingezet met NVIDIA’s gevalideerde MGX-ontwerp, NVLink-connectiviteit en Spectrum-X-netwerk, zonder een volledig losstaande omgeving te bouwen. 1
Daarmee is dit evenzeer een platformstrategie als een chippartnerschap. NVIDIA kan infrastructuurklanten op zijn rackfundament houden, terwijl gespecialiseerde chips een afzonderlijk knelpunt in inferentie aanpakken. De commerciële waarde hangt uiteindelijk af van beschikbaarheid, softwareondersteuning, kosten en prestaties op echte workloads zodra Raptor wordt geleverd.
d-Matrix verwacht dat Raptor eind 2026 zijn tape-out bereikt en mikt op eerste beschikbaarheid in een MGX-rack in het vierde kwartaal van 2027. Dit zijn toekomstgerichte roadmapdata en ze kunnen nog veranderen. 9
11
Het huidige Corsair-XPU-platform van het bedrijf is al in productie. In een afzonderlijke uitrol kondigde Parasail aan Corsair-versnellers te combineren met NVIDIA Hopper- en Blackwell-GPU’s, met GPU’s voor prefill en Corsair voor decode. Parasail en d-Matrix claimden daarbij een tot tienmaal snellere tokengeneratie. Dat is een prestatieclaim van de bedrijven, geen onafhankelijke benchmark voor Raptor. 19
d-Matrix meldde daarnaast in november 2025 een Series C-financieringsronde van 275 miljoen dollar. Daarmee werd het bedrijf gewaardeerd op 2 miljard dollar en kwam de totale financiering volgens d-Matrix uit op 450 miljoen dollar. 16
Het belangrijkste nieuws is niet alleen dat d-Matrix een NVIDIA-interconnect inzet. Raptor wordt ontworpen als een speciaal inference-onderdeel binnen NVIDIA’s MGX-rackecosysteem. Als de roadmap wordt gerealiseerd, kunnen beheerders NVIDIA-CPU’s, netwerken en GPU’s combineren met een geheugen-gerichte XPU voor de decodefase van AI-diensten, zonder zelf vanaf nul een apart rackplatform te ontwikkelen. 1
2
Voorlopig blijft dit een roadmap met een beoogde beschikbaarheid in 2027. De uiteindelijke waardepropositie moet blijken uit leverbare hardware, echte inferenceworkloads en onafhankelijke metingen van vertraging, doorvoer en totale gebruikskosten.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix wil zijn volgende generatie Raptor inference XPU’s via NVIDIA NVLink Fusion verbinden met de MGX rackarchitectuur; eerste beschikbaarheid is gepland voor het vierde kwartaal van 2027.
d Matrix wil zijn volgende generatie Raptor inference XPU’s via NVIDIA NVLink Fusion verbinden met de MGX rackarchitectuur; eerste beschikbaarheid is gepland voor het vierde kwartaal van 2027. Het beoogde MGX ontwerp omvat NVIDIA Vera CPU’s, NVLink switches, BlueField 4 DPU’s, ConnectX 9 SuperNICs en Spectrum X Ethernet.
Raptor is nog een toekomstig product. Prestaties en specificaties op rackschaal zijn daarom roadmapdoelen van het bedrijf, geen onafhankelijk bevestigde resultaten.