d Matrix planerar att använda Nvidia NVLink Fusion för att sätta sina kommande Raptor XPU:er för AI inferens i Nvidias MGX baserade infrastruktur. Upplägget delar upp inferensen: Nvidia GPU:er hanterar promptbearbetningen, medan d Matrix siktar på den löpande genereringen av svarstoken.
Publicerad avRedigerad med GPT-5.6 TerraBilder genererade med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix vill göra det enklare att använda sina kommande Raptor-processorer för AI-inferens i stora datacenter. Bolaget ska integrera Nvidias NVLink Fusion i nästa generations Raptor-XPU:er, så att de kan kopplas till Nvidias MGX-rack och bredare AI-infrastruktur i stället för att kräva ett helt separat acceleratorkluster. Samarbetet beskrivs som en flerårig produktplan, och de första Raptor-XPU:erna integrerade i MGX-rack väntas under fjärde kvartalet 2027. 1
8
NVLink Fusion är Nvidias teknik och IP för sammankoppling med hög bandbredd och låg fördröjning. Den är avsedd för att integrera kundanpassade CPU:er och XPU:er – en bred benämning på specialiserade processorer – i Nvidias AI-infrastruktur. För d-Matrix innebär det en planerad koppling mellan Raptor, NVLinks skalning inom rack, Spectrum-X för skalning mellan system och MGX-rackarkitekturen. 1
14
Det planerade racket ska innehålla Nvidia Vera-CPU:er, NVLink-switchar, BlueField-4-DPU:er, ConnectX-9-SuperNIC:ar och Spectrum-X Ethernet. En DPU är en dataprocessorenhet för bland annat nätverks- och infrastrukturuppgifter. d-Matrix säger att detta ger en validerad väg för rack, nätverk, strömförsörjning, kylning och leveranskedja – delar som en tillverkare av specialiserade acceleratorer annars måste bygga ihop på egen hand. 1
8
Det centrala är alltså systemintegration, inte bara att ansluta ytterligare ett chip till en server. En datacenteroperatör kan i teorin använda en gemensam Nvidia-inriktad grund för GPU:er, CPU:er och d-Matrix XPU:er, i stället för att konstruera särskilda rack för varje processortyp. 1
Den föreslagna arkitekturen bygger på uppdelad inferens. Nvidias GPU:er ska utföra den beräkningsintensiva prefill-fasen, där en inmatad prompt bearbetas. d-Matrix specialiserade hårdvara ska i stället rikta in sig på decode – den token-för-token-generering som bygger upp modellens svar.
Tanken är att varje processortyp ska ta den del av arbetet den är avsedd för. d-Matrix har tidigare sagt att Parasail ska använda bolagets nuvarande Corsair-acceleratorer tillsammans med Nvidias Hopper- och Blackwell-system enligt samma övergripande modell. 22
Eventuella vinster beror dock på arbetslasten. Parasails uppgift om upp till tio gånger snabbare och mer kostnadseffektiva tjänster är ett påstående från bolagen för utvalda arbetslaster, inte en oberoende verifierad och generell jämförelse mellan d-Matrix hårdvara och GPU:er. 22
d-Matrix har sagt att det första Raptor-racket ska följa Nvidias MGX-referensarkitektur. Rapportering om färdplanen beskriver en NVL144-liknande design som är tänkt att koppla samman upp till 144 Raptor-acceleratorer i ett enda NVLink-tyg. Det är framtidsplaner, inte specifikationer för en leveransklar produkt. 2
Den konkreta tillgänglighetspunkt som d-Matrix har angett är snävare: de första Raptor-XPU:erna integrerade i ett Nvidia MGX-rack väntas under Q4 2027. 8
Kunder bör därför se kapacitet, prestanda och driftsdetaljer som mål i en färdplan tills slutliga system finns tillgängliga och kan testas oberoende.
Vid första anblick kan det verka motsägelsefullt att Nvidia hjälper en annan inferensprocessor in i sin infrastruktur. Den strategiska poängen är dock att Nvidia kan bli den föredragna plattformsgrunden även när själva beräkningschipet inte är en Nvidia-GPU.
NVLink Fusion håller värdefulla plattformslager – sammankoppling, nätverk, rackarkitektur och angränsande infrastruktur – inom Nvidias ekosystem. För d-Matrix och kunderna kan det minska integrationsrisken och korta vägen till driftsättning. För Nvidia minskar det behovet av ett helt fristående kluster utan Nvidia-teknik. 1
14
Det är bakgrunden till Nvidias formulering att plattformen är ”vertikalt integrerad och horisontellt öppen”:
Det innebär inte att alla acceleratorer är utbytbara eller prestandamässigt likvärdiga. I det här sammanhanget bör ”fungibel” snarare förstås som ett driftmål: operatören kan välja den beräkningsresurs som passar en viss arbetslast, men ändå bygga på samma infrastrukturgrund.
d-Matrix plan är kompletterande till Nvidia-GPU:er i den föreslagna uppdelningen mellan prefill och decode. Samtidigt verkar Raptor inom samma breda marknad för specialiserad inferens som Nvidias planerade Groq 3-system baserade på LPU:er. Nvidia har presenterat Groq 3 LPX som en dedikerad lösning för decode som kan paras med Vera Rubin NVL72-infrastruktur. 24
Relationen blir därmed dubbel. Raptor kan komplettera Nvidia-GPU:er och använda Nvidias plattform, men kan också konkurrera med Nvidias egen specialiserade decode-lösning. Tillgänglig information räcker inte för en meningsfull direktjämförelse av latens, genomströmning, energiförbrukning, pris eller tillgänglighet.
d-Matrix uppgav att serie C-rundan i november 2025 tog in 275 miljoner dollar till en värdering på 2 miljarder dollar. Därmed uppgick bolagets totala kapitalanskaffning till 450 miljoner dollar. 27
Bolagets nuvarande inferensplattform heter Corsair, medan Raptor är nästa generations XPU i NVLink Fusion-planen. Corsair används redan i samarbetet med Parasail, som sagt att acceleratorerna ska driftsättas tillsammans med Nvidia-infrastruktur för utvalda inferensarbetslaster. 22
Ingen av parterna har redovisat de finansiella villkoren. Det finns därför inga offentliga uppgifter om licensroyaltyer, minimiåtaganden vid inköp, utvecklingsavgifter, intäktsdelning eller särskilda kommersiella villkor.
Tillkännagivandet bör därför främst ses som en betydande infrastrukturfärdplan: d-Matrix får en väg att placera specialiserad decode-hårdvara i Nvidia-baserade AI-fabriker, medan Nvidia breddar antalet beräkningschip som kan använda bolagets sammankoppling och rackekosystem. Om det verkligen leder till bättre inferensekonomi avgörs först av slutlig hårdvara, mjukvaruintegration, prissättning och oberoende reproducerbara resultat. 1
8
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix planerar att använda Nvidia NVLink Fusion för att sätta sina kommande Raptor XPU:er för AI inferens i Nvidias MGX baserade infrastruktur.
d Matrix planerar att använda Nvidia NVLink Fusion för att sätta sina kommande Raptor XPU:er för AI inferens i Nvidias MGX baserade infrastruktur. Upplägget delar upp inferensen: Nvidia GPU:er hanterar promptbearbetningen, medan d Matrix siktar på den löpande genereringen av svarstoken.
Nvidia öppnar för tredjepartskretsar, men behåller samtidigt rack, sammankoppling och nätverk i sitt eget AI ekosystem.