Raptor krijgt via NVLink Fusion directe toegang tot Nvidia’s scale up fabric en MGX rackarchitectuur, in plaats van als losstaande PCIe versneller te draaien. Nvidia levert daarbij onder meer de NVLink switches, Vera CPU’s, BlueField 4 DPU’s, ConnectX 9 SuperNICs en Spectrum X netwerken.
Gepubliceerd doorAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does d Matrix’s adoption of Nvidia’s NVLink Fusion for its next generation Raptor inference processors enable the startup to plug its me. Article summary: d Matrix is using NVLink Fusion to make Raptor a native, rack scale participant in Nvidia’s AI factory design rather than a separate PCIe inference card.. Topic tags: general web, llm, ai, code, benchmarks. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layou
NVLink Fusion moet van d-Matrix’ volgende Raptor-XPU geen losse inference-kaart maken, maar een volwaardig onderdeel van een Nvidia AI-factory op rackniveau. Voor afnemers betekent dat: gespecialiseerde, geheugengerichte hardware voor snelle AI-inference, ingebed in Nvidia’s bestaande interconnect, netwerklaag en rackontwerp. 3
5
Raptor gaat Nvidia’s NVLink Fusion-interface implementeren en wordt opgenomen in Nvidia’s vloeistofgekoelde NVL144/MGX-referentiearchitectuur. NVLink verzorgt daarbij de snelle, lage-latencyverbinding tussen apparaten binnen de scale-up-omgeving. Voor verbindingen buiten het rack is Spectrum-X bedoeld als scale-out-netwerk. 3
5
d-Matrix levert dus de XPU — een processor voor AI-inference — terwijl Nvidia een groot deel van de onderliggende systeeminfrastructuur levert. Een Raptor-rack kan onder meer bestaan uit Nvidia Vera-CPU’s, NVLink-switches, BlueField-4-DPU’s, ConnectX-9-SuperNICs en Spectrum-X Ethernet. Dat omvat de rekeninfrastructuur, I/O, netwerkverbindingen, beheerfuncties en het gevalideerde referentieontwerp voor het rack. 5
6
GPU’s blijven relevant voor onder meer de zogeheten prefill-fase — waarin een model een volledige invoer verwerkt — en voor algemene rekentaken. d-Matrix richt Raptor vooral op de daaropvolgende decode-fase, waarin een taalmodel token voor token output genereert. Omdat daarbij modelgewichten voortdurend opnieuw worden gelezen, zijn geheugencapaciteit en geheugenbandbreedte bijzonder belangrijk.
De inzet is daarom een complementaire GPU-XPU-pijplijn: GPU’s hoeven niet volledig te worden vervangen, maar Raptor moet de tokenlatentie bij inference verlagen. 3
10
d-Matrix noemt als doel voor een rack maximaal 144 Raptor-XPU’s, met in totaal circa 2,3 TB 3D-gestapeld DRAM en 7,2 PB/s aan geaggregeerde geheugenbandbreedte. Volgens het bedrijf zou die capaciteit in theorie ruimte bieden aan modellen met meer dan vier biljoen parameters in 4-bitprecisie. In de praktijk hangt de bruikbare modelgrootte ook af van metadata, runtime-status, het modelformaat en software-overhead. 3
Raptor is beschreven als een 4-nm-compute-die gecombineerd met aangepast DRAM. d-Matrix verwacht tape-out tegen eind 2026; de eerste in racks geïntegreerde systemen staan gepland voor het vierde kwartaal van 2027. 10
4
Voor Nvidia kan NVLink Fusion ervoor zorgen dat klanten die voor gespecialiseerde chips van derden kiezen, toch binnen Nvidia’s infrastructuurecosysteem blijven. Nvidia kan in dat scenario nog steeds de rackarchitectuur, fabric, switches, CPU’s, DPU’s, SuperNICs, Ethernet en aanverwante infrastructuur leveren. Dat is een gevolgtrekking uit de architectuur en het commerciële model, niet een bekendgemaakt detail over de financiële afspraken tussen de partijen. 3
5
d-Matrix sluit zich daarmee aan bij Nvidia’s bredere NVLink Fusion-initiatief, waar ook partners als AWS, Arm, Intel, Fujitsu, MediaTek en Marvell mee worden geassocieerd. Het doel is NVLink te verbreden van een interne Nvidia-interconnect naar een platforminterface voor heterogene AI-hardware. 3
d-Matrix bracht zijn Corsair-inferenceversneller in november 2024 uit. Later haalde het bedrijf volgens berichtgeving 275 miljoen dollar op in een Series C, bij een waardering van 2 miljard dollar. De totale financiering werd daarbij op ongeveer 450 miljoen dollar geschat; dat is dus niet hetzelfde als één financieringsronde van 450 miljoen dollar. 2
De financiële voorwaarden van de samenwerking met Nvidia zijn niet bekendgemaakt. 1
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Raptor krijgt via NVLink Fusion directe toegang tot Nvidia’s scale up fabric en MGX rackarchitectuur, in plaats van als losstaande PCIe versneller te draaien.
Raptor krijgt via NVLink Fusion directe toegang tot Nvidia’s scale up fabric en MGX rackarchitectuur, in plaats van als losstaande PCIe versneller te draaien. Nvidia levert daarbij onder meer de NVLink switches, Vera CPU’s, BlueField 4 DPU’s, ConnectX 9 SuperNICs en Spectrum X netwerken.
d Matrix positioneert Raptor vooral voor de token voor token decodefase van AI inference, waar geheugenbandbreedte en capaciteit cruciaal zijn.