Raptor ma korzystać z NVLink Fusion i referencyjnej architektury NVIDIA MGX, dzięki czemu będzie częścią systemu rack scale, a nie odizolowaną kartą PCIe. NVLink zapewnia szybką komunikację scale up wewnątrz systemu, a Spectrum X odpowiada za skalowanie sieci poza rack.
Opublikowane przezObrazy wygenerowane za pomocą GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does d Matrix’s adoption of Nvidia’s NVLink Fusion for its next generation Raptor inference processors enable the startup to plug its me. Article summary: d Matrix is using NVLink Fusion to make Raptor a native, rack scale participant in Nvidia’s AI factory design rather than a separate PCIe inference card.. Topic tags: general web, llm, ai, code, benchmarks. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layou
Najważniejsza zmiana polega na tym, że d-Matrix nie zamierza po prostu podłączyć Raptora jako zewnętrznej karty PCIe do serwera z GPU. Dzięki NVIDIA NVLink Fusion jego przyszły akcelerator inferencji Raptor XPU ma zostać włączony bezpośrednio do architektury systemów NVIDIA: chłodzonych cieczą szaf opartych na MGX/NVL144. To pozwala połączyć pamięciocentryczny układ d-Matrix z gotową „instalacją” infrastrukturalną NVIDIA — magistralą scale-up, siecią, wejściem/wyjściem, zarządzaniem i projektem całego racka. 3
5
Raptor ma implementować interfejs NVLink Fusion i współpracować z referencyjną architekturą NVIDIA MGX. NVLink tworzy szybkie, niskolatencyjne połączenie typu scale-up między urządzeniami w systemie, natomiast Spectrum-X zapewnia sieć scale-out, czyli rozszerzanie komunikacji poza pojedynczą szafę. 3
5
W praktyce oznacza to, że d-Matrix dostarcza własny układ XPU, lecz nie musi samodzielnie budować całej platformy serwerowej. Projekt racka może obejmować procesory NVIDIA Vera, przełączniki NVLink, jednostki DPU BlueField-4, karty sieciowe ConnectX-9 SuperNIC oraz Ethernet Spectrum-X. 5
6
d-Matrix pozycjonuje Raptora jako układ do etapu decode — generowania kolejnych tokenów przez model językowy. W tym obciążeniu model wielokrotnie odczytuje wagi z pamięci, więc pojemność oraz przepustowość pamięci są szczególnie istotne dla opóźnienia pojedynczego tokenu.
GPU wciąż mogą być przydatne przy etapie prefill, czyli początkowym przetwarzaniu dużego promptu, a także w zadaniach ogólnego przeznaczenia. Plan d-Matrix zakłada więc raczej komplementarny potok GPU–XPU niż pełne zastąpienie GPU. 3
10
Według deklaracji d-Matrix docelowy rack ma mieścić do 144 akceleratorów Raptor XPU, oferując łącznie około 2,3 TB pamięci 3D-stacked DRAM i 7,2 PB/s szczytowej zagregowanej przepustowości pamięci. Firma wskazuje, że taka pojemność mogłaby zasadniczo pomieścić model przekraczający cztery biliony parametrów przy kwantyzacji 4-bitowej. Rzeczywisty rozmiar możliwego do wdrożenia modelu będzie jednak zależeć również od metadanych, stanu wykonywania i narzędzi programowych. 3
Raptor jest opisywany jako konstrukcja z 4-nanometrowym układem obliczeniowym połączonym z niestandardową pamięcią DRAM. d-Matrix oczekuje tape-outu do końca 2026 r., zaś pierwszych zintegrowanych systemów rackowych w IV kwartale 2027 r. 10
4
Dla NVIDIA NVLink Fusion jest sposobem na utrzymanie centralnej roli w systemie nawet wtedy, gdy głównym układem inferencyjnym nie jest GPU NVIDIA. Klient wybierający wyspecjalizowany XPU d-Matrix nadal może korzystać z architektury racka NVIDIA, jej połączeń NVLink, przełączników, CPU, DPU, kart sieciowych, Ethernetu i otaczającej infrastruktury.
To wniosek wynikający z architektury i modelu współpracy, a nie ujawniona informacja o ekonomice umowy — jej warunków finansowych firmy nie podały. 1
3
5
d-Matrix dołącza do ekosystemu NVLink Fusion, z którym publicznie wiązani są także m.in. AWS, Arm, Intel, Fujitsu, MediaTek i Marvell. Strategia NVIDIA polega na uczynieniu NVLink interfejsem platformowym dla heterogenicznego sprzętu „fabryk AI”, a nie wyłącznie technologią łączenia własnych akceleratorów. 3
Firma d-Matrix wprowadziła poprzedni akcelerator inferencyjny Corsair w listopadzie 2024 r. W późniejszym finansowaniu uczestniczył fundusz M12 należący do Microsoftu. Runda Series C o wartości 275 mln dolarów wyceniła firmę na 2 mld dolarów, podczas gdy łączne finansowanie d-Matrix opisywano jako około 450 mln dolarów — nie należy traktować tej drugiej kwoty jako wartości pojedynczej rundy. 2
6
ParaSail informował o nawet dziesięciokrotnym wzroście szybkości inferencji po połączeniu Corsaira z GPU NVIDIA, ale jest to deklaracja firmy lub klienta, a nie niezależny benchmark. 12
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Raptor ma korzystać z NVLink Fusion i referencyjnej architektury NVIDIA MGX, dzięki czemu będzie częścią systemu rack scale, a nie odizolowaną kartą PCIe.
Raptor ma korzystać z NVLink Fusion i referencyjnej architektury NVIDIA MGX, dzięki czemu będzie częścią systemu rack scale, a nie odizolowaną kartą PCIe. NVLink zapewnia szybką komunikację scale up wewnątrz systemu, a Spectrum X odpowiada za skalowanie sieci poza rack.
W konfiguracji z Raptorem NVIDIA dostarcza m.in. procesory Vera, przełączniki NVLink, DPU BlueField 4, SuperNIC ConnectX 9 oraz Ethernet Spectrum X.