d Matrix wil zijn volgende generatie Raptor inference XPU’s via Nvidia NVLink Fusion opnemen in Nvidia MGX gebaseerde AI infrastructuur. De opzet verdeelt AI inference: Nvidia GPU’s doen de rekenintensieve prefill fase, terwijl Raptor is bedoeld voor het token voor token genereren tijdens decode.
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix kiest voor een directe route naar Nvidia’s AI-infrastructuur. De start-up wil Nvidia NVLink Fusion integreren in zijn volgende generatie Raptor-XPU’s voor AI-inference. Daardoor moeten die chips kunnen draaien in Nvidia’s MGX-rackarchitectuur, in plaats van uitsluitend in een afzonderlijk, zelf ontworpen acceleratorsysteem. De bedrijven spreken over een meerjarige productroadmap; de eerste Raptor-XPU’s in een Nvidia MGX-rack worden verwacht in het vierde kwartaal van 2027. 1
8
NVLink Fusion is Nvidia’s technologie en intellectueel eigendom voor verbindingen met hoge bandbreedte en lage latentie. Daarmee kunnen leveranciers eigen CPU’s en XPU’s — gespecialiseerde processors — aansluiten op Nvidia’s AI-infrastructuur. Voor d-Matrix betekent dat aansluiting op NVLink voor scale-up-netwerken binnen een systeem, Spectrum-X voor scale-out-netwerken tussen systemen en de MGX-rackarchitectuur. 1
14
De beoogde rackconfiguratie omvat Nvidia Vera-CPU’s, NVLink-switches, BlueField-4-DPU’s, ConnectX-9-SuperNICs en Spectrum-X-Ethernet. Volgens d-Matrix biedt dit een al gevalideerd pad voor de integratie van racks, netwerken, stroomvoorziening, koeling en toelevering — onderdelen die een maker van eigen accelerators anders zelf moet samenbrengen. 1
8
De kern van de aankondiging is dus systeemintegratie. Een datacenterexploitant zou GPU’s, CPU’s en d-Matrix-XPU’s kunnen gebruiken binnen één Nvidia-georiënteerde infrastructuurbasis, zonder voor elk processortype aparte racks te ontwerpen. 1
De voorgestelde architectuur gebruikt zogeheten ontkoppelde inference. Nvidia-GPU’s verwerken de rekenintensieve prefill-fase: het verwerken van een prompt. d-Matrix richt zijn gespecialiseerde hardware vervolgens op de decode-fase, waarin een model token voor token zijn antwoord produceert.
Die taakverdeling moet elk type processor inzetten voor het deel van inference waarvoor het is ontworpen. Parasail kondigde eerder aan de huidige Corsair-accelerators van d-Matrix naast Nvidia Hopper- en Blackwell-systemen te gebruiken volgens dezelfde brede prefill/decode-opzet. 22
De mogelijke winst blijft wel afhankelijk van de werklast. Parasail spreekt van diensten die tot tien keer sneller en kostenefficiënter zijn, maar dat is een claim van het bedrijf en zijn partner voor geselecteerde toepassingen — geen onafhankelijk gevalideerde, algemene vergelijking tussen d-Matrix-hardware en GPU’s. 22
d-Matrix heeft aangegeven dat zijn eerste Raptor-rack Nvidia’s MGX-referentiearchitectuur volgt. In berichtgeving over de roadmap wordt een ontwerp in NVL144-stijl genoemd, bedoeld om maximaal 144 Raptor-accelerators in één NVLink-fabric te verbinden. Dit zijn toekomstplannen, geen gegarandeerde specificaties van een geleverd product. 2
De concreet aangekondigde beschikbaarheidsmijlpaal is beperkter: de eerste Raptor-XPU’s die in een Nvidia MGX-rack zijn geïntegreerd, worden verwacht in Q4 2027. 8
Zolang Raptor nog geen geleverd MGX-product is, moeten klanten prestaties, capaciteit en implementatiedetails daarom als roadmapdoelen beschouwen. Vergelijkbare, onafhankelijk testbare benchmarks zijn pas mogelijk met definitieve systemen.
Op het eerste gezicht lijkt het opmerkelijk dat Nvidia een externe inferenceprocessor ondersteunt. Strategisch kan het juist aantrekkelijk zijn: Nvidia maakt zijn platform aantrekkelijker, ook wanneer de rekentaak niet volledig op een Nvidia-GPU draait.
Met NVLink Fusion blijven waardevolle platformlagen — de scale-up-fabric, netwerken, rackarchitectuur en bijbehorende infrastructuur — onderdeel van Nvidia’s ecosysteem. Voor d-Matrix en diens klanten kan dat integratierisico verminderen en inzet versnellen. Voor Nvidia verkleint het de noodzaak voor klanten om een volledig los, niet-Nvidia-cluster te bouwen. 1
14
Dat is de strekking van Nvidia’s omschrijving van het platform als ‘verticaal geïntegreerd en horizontaal open’:
Dat betekent niet dat alle accelerators onderling uitwisselbaar of even snel zijn. ‘Fungibel’ is hier vooral een operationeel streven: beheerders kunnen een processor kiezen die bij een werklast past, terwijl ze op dezelfde infrastructuurbasis blijven werken.
Raptor is in de voorgestelde prefill/decode-verdeling complementair aan Nvidia-GPU’s. Tegelijk opereert het in hetzelfde brede segment als Nvidia’s geplande Groq 3-systemen op basis van LPU’s. Nvidia heeft Groq 3 LPX gepresenteerd als een speciaal voor decode ontworpen oplossing, die kan worden gecombineerd met Vera Rubin NVL72-infrastructuur. 24
Daarmee ontstaat een dubbele verhouding: Raptor kan GPU’s aanvullen en Nvidia-infrastructuur gebruiken, maar kan ook concurreren met Nvidia’s eigen gespecialiseerde decode-aanbod. De beschikbare informatie biedt geen basis voor een zinvolle directe vergelijking van latentie, doorvoer, energieverbruik, prijs of beschikbaarheid.
d-Matrix meldde dat het in november 2025 275 miljoen dollar ophaalde in een Series C-financieringsronde tegen een waardering van 2 miljard dollar. Daarmee kwam de totale financiering volgens het bedrijf op 450 miljoen dollar. 27
Het huidige inferenceplatform van d-Matrix heet Corsair; Raptor is de volgende generatie XPU die in de NVLink Fusion-roadmap wordt genoemd. Corsair is ook de basis van de samenwerking met Parasail, dat de accelerators naast Nvidia-infrastructuur wil inzetten voor geselecteerde inferencewerklasten. 22
De betekenis van Raptor is dat d-Matrix nu een directere route plant naar Nvidia’s infrastructuur op rackschaal.
Beide bedrijven maakten geen financiële voorwaarden bekend. Daardoor is publiekelijk niet vast te stellen of er licentieroyalty’s, minimale afnameverplichtingen, ontwikkelingsvergoedingen, omzetdeling of voorkeursvoorwaarden zijn afgesproken.
De aankondiging is daarom vooral een belangrijke infrastructuurroadmap: d-Matrix krijgt een pad om gespecialiseerde decodehardware in Nvidia-gebaseerde AI-fabrieken uit te rollen, terwijl Nvidia meer typen rekenchips laat steunen op zijn interconnect- en rackecosysteem. Of dat ook aantoonbaar betere inference-economie oplevert, hangt af van de uiteindelijke hardware, software-integratie, prijzen en onafhankelijk reproduceerbare resultaten per werklast. 1
8
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix wil zijn volgende generatie Raptor inference XPU’s via Nvidia NVLink Fusion opnemen in Nvidia MGX gebaseerde AI infrastructuur.
d Matrix wil zijn volgende generatie Raptor inference XPU’s via Nvidia NVLink Fusion opnemen in Nvidia MGX gebaseerde AI infrastructuur. De opzet verdeelt AI inference: Nvidia GPU’s doen de rekenintensieve prefill fase, terwijl Raptor is bedoeld voor het token voor token genereren tijdens decode.
Nvidia stelt zijn netwerk , interconnect en racklagen open voor externe chips, maar houdt zo wel het infrastructuurecosysteem centraal.