d Matrix wil Raptor XPU’s via Nvidia NVLink Fusion in MGX racks integreren, in plaats van ze alleen als losse PCIe versnellers te leveren. De beoogde configuratie combineert Raptor met Nvidia Vera CPU’s, NVLink switches, BlueField 4 DPU’s, ConnectX 9 SuperNICs en Spectrum X Ethernet.
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does d-Matrix’s adoption of Nvidia’s NVLink Fusion for its next-generation Raptor inference processors enable the startup to plug its me. Article summary: d-Matrix is using NVLink Fusion to make Raptor a native, rack-scale participant in Nvidia’s AI-factory design rather than a separate PCIe inference card. That gives customers a memory-centric accelerator for latency-sens. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
d-Matrix’ overeenkomst met Nvidia rond NVLink Fusion draait in de kern om integratie. Raptor moet niet slechts een inferentiekaart worden die via een gewone serveruitbreiding wordt aangesloten, maar een onderdeel van Nvidia’s AI-infrastructuur op rack-schaal. Het idee is d-Matrix’ geheugen-gerichte inferentieprocessor te combineren met de systeemarchitectuur, interconnects en netwerken die al in Nvidia’s AI-fabrieken worden gebruikt. 3
10
NVLink Fusion is Nvidia’s platform om chips van partners in Nvidia-gebaseerde AI-infrastructuur op te nemen. Voor d-Matrix betekent dat een koppeling van Raptor aan Nvidia’s NVLink-scale-upnetwerk, de MGX-rackarchitectuur en Spectrum-X voor scale-outnetwerken. Nvidia positioneert die aanpak als een snellere route met minder integratierisico naar grootschalige inzet: een partner bouwt voort op een gevalideerd rack-ecosysteem, in plaats van iedere systeemlaag zelf samen te stellen. 3
Praktisch gezien is Raptor voorzien als onderdeel van een rack op basis van Nvidia’s MGX-referentieontwerp. Dat is wezenlijk iets anders dan een los verkrijgbare accelerator: Raptor wordt onderdeel van een rack-scale systeem met een gedeelde fabric met hoge bandbreedte en een vooraf bepaalde infrastructuurconfiguratie. 3
10
Het geplande Raptor-systeem omvat de volgende onderdelen van Nvidia’s platform:
d-Matrix werkt daarnaast met Astera Labs aan maatwerkconnectiviteit die een datastroom met hoge doorvoer in het systeem moet ondersteunen. 10
De taakverdeling is strategisch relevant: d-Matrix levert de inferentie-XPU, terwijl Nvidia een groot deel van het omliggende platform levert — de referentiearchitectuur, scale-upconnectiviteit, netwerkonderdelen en het bredere AI-infrastructuurecosysteem. 3
10
Raptor is bedoeld voor inferentiewerk waarbij de vertraging bij het genereren van tokens belangrijk is. Een geheugen-gerichte accelerator kan daarbij relevant zijn, omdat tijdens het genereren herhaaldelijk modelgewichten moeten worden geraadpleegd. Nvidia’s platform levert vervolgens de communicatie- en implementatiebasis om dat op rack-schaal te laten werken.
De samenwerking betekent niet dat Raptor Nvidia-GPU’s voor al het AI-werk vervangt. Zij opent juist een route naar heterogene systemen, waarin gespecialiseerde inferentiechips naast Nvidia-infrastructuur kunnen draaien. Nvidia’s NVLink Fusion-strategie is nadrukkelijk gericht op semi-custom AI-infrastructuur die partnerchips combineert met Nvidia-racks en -netwerken. 26
d-Matrix verwacht systemen te kunnen aanbieden met maximaal 144 Raptor-accelerators, verbonden via één all-to-all NVLink-fabric. De door het bedrijf genoemde doelen op rackniveau zijn 2,3 TB 3D-gestapeld DRAM en 7,2 PB/s totale geheugenbandbreedte. Daarmee zouden modellen van meer dan vier biljoen parameters bij 4-bitprecisie ondersteund kunnen worden. 2
4
Deze cijfers zijn toekomstgerichte productdoelen. In openbare berichtgeving verschillen de beschrijvingen van geheugen en bandbreedte per accelerator. De uiteindelijke configuratie per chip en de bruikbare modelcapaciteit moeten dus nog worden bevestigd wanneer het product dichter bij lancering komt. Ook runtimegeheugen, modelmetadata, het gebruikte kwantisatieformaat en de systeemsoftware bepalen hoe groot een model in de praktijk kan zijn.
Raptor wordt omschreven als een ontwerp met een compute-die op 4 nanometer en aangepast DRAM. d-Matrix verwacht de tape-out — het moment waarop het chipontwerp naar de productievoorbereiding gaat — vóór eind 2026. De eerste in racks geïntegreerde systemen worden in het vierde kwartaal van 2027 verwacht. 10
14
Het gaat dus om een productroadmap voor meerdere jaren, niet om een gezamenlijk rackproduct dat nu al leverbaar is. 12
Door zijn rack-scale platform open te stellen voor partnerchips kan Nvidia klanten bedienen die gespecialiseerde chips willen, zonder dat zij Nvidia’s infrastructuurstack hoeven te verlaten. Ook wanneer d-Matrix de inferentieprocessor levert, kan het voorgestelde systeem nog steeds gebruikmaken van Nvidia’s NVLink-fabric, CPU’s, switches, DPU’s, SuperNICs, Ethernet-netwerken en MGX-architectuur. 3
10
Dat is een gevolgtrekking uit de systeemarchitectuur, geen bekendgemaakte afspraak over omzetverdeling of andere commerciële voorwaarden. De bedrijven hebben geen financiële details openbaar gemaakt. 1
Nvidia introduceerde NVLink Fusion om samen met partners semi-custom AI-infrastructuur mogelijk te maken. Op de eerste openbare partnerlijst stonden MediaTek, Marvell, Alchip Technologies, Astera Labs, Synopsys en Cadence. Nvidia meldde ook dat CPU’s van Fujitsu en Qualcomm via het platform met Nvidia-GPU’s kunnen worden geïntegreerd. 26
d-Matrix breidt die aanpak uit naar inferentiegerichte XPU’s. De bredere betekenis zit minder in één chip dan in een modulairder rackmodel: klanten kunnen in potentie eigen of gespecialiseerde rekensilicon combineren met Nvidia’s interconnect- en netwerkinfrastructuur, in plaats van te moeten kiezen tussen een volledig Nvidia-systeem of een volledig losstaand platform.
d-Matrix lanceerde zijn Corsair-inferentieaccelerator in november 2024. In november 2025 meldde het bedrijf een Series C-financieringsronde van 275 miljoen dollar bij een waardering van 2 miljard dollar. Daarmee kwam de totale opgehaalde financiering op 450 miljoen dollar; M12 van Microsoft behoorde tot de investeerders. 28
39
Met de Raptor-samenwerking probeert d-Matrix dus de stap te zetten van een afzonderlijke inferentieaccelerator naar een model voor implementatie op rack-schaal. Of de beloofde voordelen rond vertraging, capaciteit en bandbreedte ook tot productiesystemen leiden, zal afhangen van de uiteindelijke chip, software-integratie en praktijkbenchmarks wanneer de geplande systemen in 2027 verschijnen.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix wil Raptor XPU’s via Nvidia NVLink Fusion in MGX racks integreren, in plaats van ze alleen als losse PCIe versnellers te leveren.
d Matrix wil Raptor XPU’s via Nvidia NVLink Fusion in MGX racks integreren, in plaats van ze alleen als losse PCIe versnellers te leveren. De beoogde configuratie combineert Raptor met Nvidia Vera CPU’s, NVLink switches, BlueField 4 DPU’s, ConnectX 9 SuperNICs en Spectrum X Ethernet.
Volgens d Matrix kan een rack met 144 Raptor XPU’s 2,3 TB 3D gestapeld DRAM en 7,2 PB/s aan totale geheugenbandbreedte bieden; dit zijn aangekondigde streefwaarden.