d Matrix planlegger å koble neste generasjon Raptor XPU er til Nvidias MGX baserte AI infrastruktur via NVLink Fusion. Løsningen er laget for delt inferens: Nvidia GPU er tar den tunge prefill fasen, mens Raptor skal håndtere token for token dekodingen.
Publisert avRedigert med GPT-5.6 TerraBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix vil integrere Nvidias NVLink Fusion i sine neste Raptor-XPU-er for AI-inferens. Målet er å la brikkene inngå i Nvidias MGX-rackarkitektur og øvrige AI-infrastruktur, i stedet for at kundene må bygge en separat klynge rundt d-Matrix-maskinvare. Selskapene omtaler dette som en flerårig produktplan, og de første Raptor-XPU-ene integrert i MGX-rack er ventet i fjerde kvartal 2027. 1
8
NVLink Fusion er Nvidias teknologi og IP for høybåndbredde- og lavlatenskommunikasjon, utviklet for å koble tilpassede CPU-er og XPU-er til selskapets AI-infrastruktur. For d-Matrix innebærer det at Raptor kan kobles mot NVLink for oppskalering innenfor et system, Spectrum-X for skalering mellom systemer og MGX-rackdesignene fra Nvidia. 1
14
Det planlagte racket skal omfatte Nvidia Vera-CPU-er, NVLink-svitsjer, BlueField-4-DPU-er, ConnectX-9 SuperNIC-er og Spectrum-X Ethernet. d-Matrix sier at dette gir en mer utprøvd vei gjennom arbeid med rack, nettverk, strøm, kjøling og forsyningskjede – områder en leverandør av spesialiserte akseleratorer ellers ofte må sette sammen selv. 1
8
Poenget er dermed mer enn å montere enda en type brikke i en server. En datasenteroperatør kan i prinsippet bruke en felles Nvidia-orientert infrastruktur for GPU-er, CPU-er og d-Matrix-XPU-er, fremfor å konstruere egne rack for hver prosessortype. 1
Den foreslåtte arkitekturen bygger på delt inferens. Nvidia-GPU-er skal ta seg av den beregningstunge prefill-fasen, mens d-Matrix’ spesialiserte maskinvare er rettet mot decode-fasen, der modellen produserer ett og ett token i svaret.
Prefill betyr i praksis at inndata eller spørsmålet behandles. Decode er den fortløpende genereringen av tekst, token for token. Tanken er at hver prosessortype skal brukes til den delen av inferensarbeidet den er konstruert for.
d-Matrix har tidligere sagt at Parasail vil bruke dagens Corsair-akseleratorer sammen med Nvidia Hopper- og Blackwell-systemer etter samme hovedmodell: GPU-er for prefill og d-Matrix for dekoding. 22
Det er likevel viktig å skille planen fra dokumentert ytelse. Parasails påstand om opptil ti ganger raskere og mer kostnadseffektive tjenester gjelder utvalgte arbeidslaster og kommer fra selskapene selv. Den er ikke en uavhengig, generell sammenligning mellom d-Matrix-maskinvare og GPU-er. 22
d-Matrix har opplyst at det første Raptor-racket skal følge Nvidias MGX-referansearkitektur. Veikartet er omtalt som et NVL144-lignende design som er ment å koble opptil 144 Raptor-akseleratorer i ett NVLink-stoff. Dette er imidlertid fremtidige planer, ikke spesifikasjoner for et produkt som allerede er i salg. 2
Det konkrete tilgjengelighetspunktet er mer avgrenset: De første Raptor-XPU-ene integrert i et Nvidia MGX-rack er ventet i Q4 2027. 8
Ettersom Raptor ennå ikke er et leveringsklart MGX-produkt, bør kunder behandle opplysninger om kapasitet, ytelse og drift som mål i et veikart inntil ferdige systemer og uavhengig testbare målinger foreligger.
Det kan ved første øyekast virke som om Nvidia svekker sin egen posisjon ved å slippe til en ekstern inferensakselerator. Den strategiske logikken er snarere at Nvidia kan gjøre sin plattform til det foretrukne fundamentet, selv når selve beregningsbrikken ikke er en Nvidia-GPU.
NVLink Fusion holder verdifulle plattformlag – blant annet sammenkobling, nettverk, rackarkitektur og tilhørende infrastruktur – innenfor Nvidias økosystem. For d-Matrix og kundene kan det redusere integrasjonsrisiko og forkorte veien til utrulling. For Nvidia blir behovet for en helt separat, ikke-Nvidia-basert klynge mindre. 1
14
Dette er bakgrunnen for Nvidias formulering om at plattformen er «vertikalt integrert og horisontalt åpen»:
Det betyr ikke at alle akseleratorer er direkte utskiftbare eller leverer samme ytelse. «Fungibel» bør her forstås som et driftsmål: Operatøren kan velge databehandlingsressurs etter arbeidslast, mens grunninfrastrukturen i større grad er felles.
d-Matrix’ plan utfyller Nvidia-GPU-er i den foreslåtte fordelingen mellom prefill og decode. Samtidig befinner Raptor seg i samme brede marked for spesialiserte inferensprosessorer som Nvidias planlagte Groq 3 LPU-baserte systemer. Nvidia har presentert Groq 3 LPX som en dedikert løsning for decode, som kan kombineres med Vera Rubin NVL72-infrastruktur. 24
Raptor får dermed en dobbel rolle: Den kan være et supplement til Nvidia-GPU-er og bruke Nvidias plattform, men kan også konkurrere med Nvidias egen spesialiserte decode-løsning. Det foreligger ikke nok informasjon til å trekke en meningsfull konklusjon om direkte forskjeller i latenstid, gjennomstrømming, strømforbruk, pris eller tilgjengelighet.
d-Matrix opplyste at Serie C-runden i november 2025 hentet inn 275 millioner dollar, til en verdsettelse på 2 milliarder dollar. Det brakte selskapets samlede finansiering til 450 millioner dollar. 27
Corsair er d-Matrix’ nåværende inferensplattform, mens Raptor er neste generasjons XPU i NVLink Fusion-planen. Corsair ligger allerede til grunn for samarbeidet med Parasail, som sa at selskapet vil distribuere akseleratorene sammen med Nvidia-infrastruktur for utvalgte inferensarbeidslaster. 22
Det nye med Raptor er derfor den planlagte, mer direkte veien inn i Nvidias rackskala-miljø.
Ingen av selskapene har opplyst de økonomiske vilkårene. Det offentlige materialet sier derfor ingenting om lisensroyalty, minimumskjøp, ingeniørhonorarer, inntektsdeling eller eventuelle særskilte kommersielle betingelser.
Samarbeidet bør først og fremst leses som et betydelig infrastrukturelt veikart: d-Matrix får en mulig vei til å rulle ut spesialisert decode-maskinvare i Nvidia-baserte AI-fabrikker, mens Nvidia utvider utvalget av beregningsbrikker som kan bruke selskapets sammenkobling, nettverk og rackøkosystem. Om dette faktisk gir bedre inferensøkonomi i drift, avhenger av ferdig maskinvare, programvareintegrasjon, prising og uavhengig reproduserbare resultater for konkrete arbeidslaster. 1
8
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix planlegger å koble neste generasjon Raptor XPU er til Nvidias MGX baserte AI infrastruktur via NVLink Fusion.
d Matrix planlegger å koble neste generasjon Raptor XPU er til Nvidias MGX baserte AI infrastruktur via NVLink Fusion. Løsningen er laget for delt inferens: Nvidia GPU er tar den tunge prefill fasen, mens Raptor skal håndtere token for token dekodingen.
Samarbeidet gir d Matrix tilgang til Nvidias nettverk og rackkomponenter, samtidig som Nvidia beholder sentrale infrastrukturlag i sitt eget økosystem.