d Matrix planlægger at koble næste generation af Raptor inferens XPU’er til NVIDIAs NVLink Fusion og MGX rackarkitektur med første tilgængelighed målrettet 4. Det foreslåede MGX design omfatter NVIDIA Vera CPU’er, NVLink switche, BlueField 4 DPU’er, ConnectX 9 SuperNIC’er og Spectrum X Ethernet.
Udgivet afRedigeret med GPT-5.6 TerraBilleder genereret med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion technology into its next-generation Raptor inference pro. Article summary: d-Matrix announced a multiyear roadmap partnership to design its next-generation Raptor inference XPUs for NVIDIA NVLink Fusion, beginning with integration into NVIDIA’s MGX rack reference architecture. The aim is a rack. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix vil integrere sine kommende Raptor-XPU’er til AI-inferens i NVIDIAs rackinfrastruktur gennem NVLink Fusion. Samarbejdet er en flerårig produktplan, og det første Raptor-baserede system i et NVIDIA MGX-rack er planlagt til at blive tilgængeligt i 4. kvartal 2027. Målet er AI-inferens i stor skala, hvor meget lav latenstid er afgørende. 1
2
11
NVLink Fusion er NVIDIAs platform til at koble tredjeparts-CPU’er og acceleratorer til selskabets NVLink-netværk til scale-up samt øvrige AI-infrastruktur. d-Matrix vil forbinde Raptor-XPU’erne via NVLink og bruge Spectrum-X Ethernet til scale-out-netværk. 1
Det betyder i praksis, at d-Matrix kan bygge sit specialiserede inferenssilicium ind i et etableret NVIDIA-rackdesign i stedet for selv at skulle udvikle og kvalificere en komplet platform til rack, netværk og køling. NVIDIA og d-Matrix fremhæver det som en hurtigere vej med lavere integrationsrisiko fra specialchip til stor udrulning. 1
2
Raptor-systemet skal bygges på NVIDIAs nyeste MGX-referencearkitektur. Ifølge d-Matrix vil designet omfatte:
MGX er en modulær rackarkitektur. NVIDIA oplyser, at integrationen vil placere Raptor i en udbredt, væskekølet AI-infrastruktur. 1
Aftalen dokumenterer kompatibilitet med NVIDIAs rackplatform, men de citerede virksomhedsmeddelelser fastslår ikke en endelig, leveringsklar Raptor-konfiguration, der specifikt markedsføres som et "NVL144"-system. Oplysninger om eksempelvis antal acceleratorer eller hukommelsesbåndbredde før lanceringen bør derfor ses som produktplansmål og ikke som implementerede eller uafhængigt testede specifikationer.
Kernen i samarbejdet er heterogen inferens: forskellige processortyper løser forskellige dele af arbejdet med at levere svar fra en generativ AI-model.
En typisk arbejdsdeling er, at GPU’er håndterer prefill – den beregningstunge fase, hvor modellen behandler brugerens prompt – mens en specialiseret accelerator håndterer decode. Decode er fasen, hvor modellen genererer tokens ét ad gangen, og hvor svartid er særligt vigtig. d-Matrix positionerer Raptor til denne decode-orienterede opgave. 18
19
Raptor følger efter d-Matrix’ Corsair-platform, som allerede er i produktion, og viderefører virksomhedens hukommelsescentrerede design. d-Matrix oplyser, at Raptor anvender 3D-stabling af DRAM, hvor en DRAM-hukommelseschip og en SRAM-beregningschip samles i samme pakke. Tanken er, at en tættere kobling mellem hukommelse og beregning bedre kan håndtere inferensarbejde med krav om lav latenstid. 2
Raptor præsenteres dermed ikke som en fuld erstatning for GPU’er. Den er tænkt som en specialiseret komponent i en NVIDIA-baseret inferensklynge, hvor hver processortype tildeles den opgave, dens arkitektur passer bedst til.
Når NVIDIA understøtter en tredjeparts-XPU gennem NVLink Fusion, udvider virksomheden mængden af hardware, der kan fungere i dens økosystem af netværk, racks og AI-infrastruktur. For kunderne er gevinsten først og fremmest integration: En specialiseret inferensaccelerator kan indgå i et valideret MGX-design med NVLink-forbindelse og Spectrum-X-netværk frem for at blive implementeret som et separat miljø. 1
Det gør aftalen til en platformstrategi såvel som et chipsamarbejde. NVIDIA kan fastholde købere på sin rackskala-infrastruktur, samtidig med at specialiseret silicium kan tage fat på en særskilt flaskehals i inferens. Den kommercielle værdi afhænger dog af tilgængelighed, softwareunderstøttelse, pris og ydelse på reelle arbejdsbelastninger, når Raptor leveres.
d-Matrix forventer, at Raptor når tape-out – det trin, hvor chipdesignet sendes til produktion – inden udgangen af 2026. Første MGX-rack med Raptor er planlagt til 4. kvartal 2027. Det er fremadrettede datoer i en produktplan og kan ændres. 9
11
Virksomhedens nuværende Corsair-XPU er allerede i produktion. I en særskilt meddelelse sagde Parasail, at selskabet vil kombinere Corsair-acceleratorer med NVIDIA Hopper- og Blackwell-GPU’er: GPU’er til prefill og Corsair til decode. Parasail og d-Matrix angav op til 10 gange hurtigere tokengenerering, men det er en ydelsespåstand fra virksomhederne selv og ikke en uafhængig benchmark af Raptor. 19
d-Matrix oplyste desuden i november 2025, at virksomheden havde rejst 275 mio. dollar i en Series C-runde. Det værdisatte virksomheden til 2 mia. dollar og bragte den samlede finansiering op på 450 mio. dollar. 16
Nyheden er ikke kun, at d-Matrix tager NVIDIAs interconnect i brug. Det afgørende er, at Raptor designes til at indgå i NVIDIAs MGX-rackøkosystem som en målrettet komponent til AI-inferens. Hvis planen realiseres, vil operatører kunne kombinere NVIDIAs CPU’er, netværk og GPU’er med en hukommelsescentreret XPU, der er optimeret til decode-fasen – uden at skulle bygge en selvstændig rackplatform fra bunden. 1
2
Indtil videre er der tale om en produktplan med et mål om tilgængelighed i 2027. Den reelle værdi skal måles på leveringsklar hardware, faktiske inferensarbejdsbelastninger og uafhængige målinger af latenstid, kapacitet og samlede ejeromkostninger.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix planlægger at koble næste generation af Raptor inferens XPU’er til NVIDIAs NVLink Fusion og MGX rackarkitektur med første tilgængelighed målrettet 4.
d Matrix planlægger at koble næste generation af Raptor inferens XPU’er til NVIDIAs NVLink Fusion og MGX rackarkitektur med første tilgængelighed målrettet 4. Det foreslåede MGX design omfatter NVIDIA Vera CPU’er, NVLink switche, BlueField 4 DPU’er, ConnectX 9 SuperNIC’er og Spectrum X Ethernet.
Raptor er fortsat et fremtidigt produkt, så ydelse og rackskala skal betragtes som mål i en produktplan – ikke som uafhængigt verificerede resultater.