d Matrix chce s technologií Nvidia NVLink Fusion nasadit příští generaci inferenčních XPU Raptor v AI infrastruktuře založené na architektuře MGX. Návrh kombinuje GPU Nvidie pro fázi prefill se specializovanými čipy d Matrix pro postupné generování tokenů ve fázi decode.
PublikovalUpraveno pomocí GPT-5.6 TerraObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix si pro nasazení AI inference ve velkém měřítku zvolil cestu, která zákazníky nenutí stavět zcela oddělený cluster akcelerátorů. Startup oznámil, že do své příští generace inferenčních XPU Raptor začlení technologii Nvidia NVLink Fusion. Čipy tak mají být propojeny s rackovou architekturou Nvidia MGX a širší infrastrukturní platformou pro AI. Firmy spolupráci popisují jako víceletý produktový plán; první XPU Raptor integrované v racku MGX mají být dostupné ve 4. čtvrtletí 2027. 1
8
NVLink Fusion je technologie a IP Nvidie pro vysokorychlostní propojení s nízkou latencí, která umožňuje začlenit vlastní CPU a XPU do AI infrastruktury Nvidie. Pro d-Matrix to znamená, že Raptor se má připojit k síti NVLink pro škálování v rámci systému, k síti Spectrum-X pro škálování mezi systémy a k rackovým návrhům MGX — namísto nasazení výhradně ve vlastním, na míru postaveném systému. 1
14
Plánovaný rack má obsahovat CPU Nvidia Vera, přepínače NVLink, DPU BlueField-4, síťové karty ConnectX-9 SuperNIC a ethernetovou síť Spectrum-X. d-Matrix uvádí, že díky tomu získá ověřenou cestu pro integraci celého okolního racku, sítí, napájení, chlazení i dodavatelského řetězce — tedy oblastí, které by výrobci vlastních akcelerátorů jinak museli skládat sami. 1
8
V praxi tedy nejde jen o připojení dalšího čipu do serveru, ale o systémovou integraci. Provozovatel datového centra by mohl pro GPU, CPU i XPU d-Matrix využít jednotný, na Nvidii orientovaný infrastrukturní přístup namísto návrhu samostatných racků pro každý typ procesoru. 1
Navrhovaná architektura počítá s rozdělenou inferencí. GPU Nvidie mají zpracovávat výpočetně náročnou fázi prefill, zatímco specializovaný hardware d-Matrix má být určen pro fázi decode, tedy postupné generování výstupních tokenů.
Prefill zpracuje vstupní prompt; decode pak vytváří navazující proud tokenů ve výstupu modelu. Cílem tohoto rozdělení je svěřit každému procesoru tu část inference, pro niž je určen. d-Matrix již dříve uvedl, že Parasail nasadí současné akcelerátory Corsair vedle systémů Nvidia Hopper a Blackwell na podobném principu rozdělení mezi prefill a decode. 22
Důležitá výhrada: případný přínos pro výkon závisí na konkrétní zátěži. Tvrzení Parasailu o službách až 10× rychlejších a nákladově efektivnějších je tvrzením firem pro vybrané pracovní zátěže, nikoli nezávisle ověřeným univerzálním srovnáním hardwaru d-Matrix s GPU. 22
d-Matrix uvedl, že jeho první rack Raptor bude vycházet z referenční architektury Nvidia MGX. Zprávy o plánu popisují návrh ve stylu NVL144, který má v jediné síti NVLink propojit až 144 akcelerátorů Raptor; jde však o budoucí záměry, nikoli o garantované parametry dodávaného produktu. 2
Konkrétní termín dostupnosti zveřejněný d-Matrix je užší: první XPU Raptor integrovaná do racku Nvidia MGX se očekávají ve 4. čtvrtletí 2027. 8
Protože Raptor zatím není dodávaným produktem pro MGX, měli by zákazníci parametry výkonu, kapacity a nasazení chápat jako cíle produktového plánu, dokud nebudou k dispozici finální systémy a nezávisle testovatelné benchmarky.
Na první pohled může podpora inferenčního procesoru třetí strany působit tak, že Nvidia oslabuje vlastní pozici. Strategická logika je však opačná: Nvidia může ze své AI platformy učinit preferovaný základ i tehdy, když samotný výpočetní čip není její GPU.
NVLink Fusion ponechává v ekosystému Nvidie hodnotné platformní vrstvy — propojení pro škálování v rámci systému, síťovou infrastrukturu, rackovou architekturu a další související prvky. Pro d-Matrix a jeho zákazníky to může snížit integrační riziko a urychlit nasazení. Pro Nvidii to zase omezuje potřebu budovat zcela samostatný cluster mimo její ekosystém. 1
14
To je podstata popisu platformy Nvidie jako „vertikálně integrované a horizontálně otevřené“.
Neznamená to, že jsou všechny akcelerátory vzájemně zaměnitelné nebo výkonově rovnocenné. „Zaměnitelnost“ je zde spíše provozním cílem: provozovatelé mohou zvolit výpočetní zdroj vhodný pro danou zátěž, přičemž využijí společný infrastrukturní základ.
Plán d-Matrix je v navrhovaném rozdělení prefill/decode doplňkem ke GPU Nvidie, zároveň ale míří do stejné širší oblasti specializované inference jako plánované systémy Nvidia Groq 3 založené na LPU. Nvidia představila Groq 3 LPX jako účelově navržené řešení pro fázi decode, které lze kombinovat s infrastrukturou Vera Rubin NVL72. 24
Vzniká tak dvojí vztah. Raptor může doplňovat GPU Nvidie a využívat její platformní infrastrukturu, zároveň však může konkurovat vlastnímu specializovanému řešení Nvidie pro decode. Z dostupných informací nelze vyvodit smysluplný přímý závěr o latenci, propustnosti, spotřebě, ceně ani dostupnosti.
d-Matrix uvedl, že v listopadu 2025 získal v investičním kole Series C 275 milionů dolarů při ocenění 2 miliardy dolarů. Celkové financování firmy tím dosáhlo 450 milionů dolarů. 27 Její současnou inferenční platformou je Corsair; Raptor je XPU nové generace uvedený v plánu NVLink Fusion.
Corsair už je základem partnerství d-Matrix se společností Parasail, která oznámila nasazení akcelerátorů vedle infrastruktury Nvidie pro vybrané inferenční zátěže. 22 Význam Raptoru spočívá v tom, že d-Matrix nyní plánuje přímější cestu do rackového prostředí Nvidie.
Ani jedna ze společností nezveřejnila finanční podmínky dohody. Veřejně dostupné informace proto neříkají nic o licenčních poplatcích, minimálních odběrech, nákladech na vývojové práce, dělení příjmů ani o případných zvýhodněných obchodních podmínkách.
Oznámení je proto vhodné chápat jako významný plán infrastruktury: d-Matrix získává cestu, jak nasazovat specializovaný hardware pro decode v AI továrnách založených na Nvidii, zatímco Nvidia rozšiřuje okruh výpočetních čipů, které mohou využívat její propojení a rackový ekosystém. Zda to přinese lepší ekonomiku inference v reálném provozu, ukážou až finální hardware, softwarová integrace, ceny a nezávisle reprodukovatelné výsledky na konkrétních zátěžích. 1
8
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix chce s technologií Nvidia NVLink Fusion nasadit příští generaci inferenčních XPU Raptor v AI infrastruktuře založené na architektuře MGX.
d Matrix chce s technologií Nvidia NVLink Fusion nasadit příští generaci inferenčních XPU Raptor v AI infrastruktuře založené na architektuře MGX. Návrh kombinuje GPU Nvidie pro fázi prefill se specializovanými čipy d Matrix pro postupné generování tokenů ve fázi decode.
Spolupráce otevírá d Matrix přístup k propojení NVLink a Spectrum X i k rackovým komponentám Nvidie, zároveň ale drží klíčové vrstvy infrastruktury v ekosystému Nvidie.