d Matrix plánuje připojit inference XPUs Raptor přímo do rackových systémů Nvidia MGX přes NVLink Fusion, nikoli je nasazovat jen jako samostatné PCIe akcelerátory. Návrh kombinuje Raptor s procesory Nvidia Vera, přepínači NVLink, DPU BlueField 4, síťovými kartami ConnectX 9 SuperNIC a ethernetem Spectrum X.
PublikovalUpraveno pomocí GPT-5.6 TerraObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does d-Matrix’s adoption of Nvidia’s NVLink Fusion for its next-generation Raptor inference processors enable the startup to plug its me. Article summary: d-Matrix is using NVLink Fusion to make Raptor a native, rack-scale participant in Nvidia’s AI-factory design rather than a separate PCIe inference card. That gives customers a memory-centric accelerator for latency-sens. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Dohoda d-Matrix s Nvidií o NVLink Fusion je především integrační krok. Raptor nemá být jen samostatnou inference kartou připojenou běžnou rozšiřovací cestou serveru, ale součástí rackové AI infrastruktury Nvidie. Cílem je spojit inference procesor orientovaný na paměť s návrhem systému, propojovací technologií a sítí, které se už používají v takzvaných AI továrnách Nvidie. 3
10
NVLink Fusion je platforma Nvidie, která umožňuje začlenit čipy partnerských firem do infrastruktury založené na Nvidii. V případě d-Matrix to znamená připojení Raptoru ke scale-up síti NVLink, rackové architektuře MGX a scale-out síti Spectrum-X. Nvidia uvádí, že partnerům tato cesta zkracuje a snižuje riziko přechodu od vlastního čipu k nasazení ve velkém měřítku: nemusejí samostatně skládat celý rackový ekosystém, ale mohou stavět na ověřené platformě. 3
Prakticky má Raptor tvořit součást racku podle referenčního návrhu MGX. To je podstatný rozdíl oproti prodeji izolovaného akcelerátoru: čip se má stát prvkem rackového systému se sdílenou vysokorychlostní propojovací strukturou a předem definovanými infrastrukturními komponentami. 3
10
Plánovaná sestava s Raptorem zahrnuje tyto prvky platformy Nvidia:
d-Matrix navíc spolupracuje s Astera Labs na zakázkovém propojení, které má v systému zajistit plynulý datový tok s vysokou propustností. 10
Rozdělení rolí je strategicky důležité: d-Matrix dodává inference XPU, zatímco Nvidia poskytuje velkou část okolní platformy — referenční architekturu, scale-up konektivitu, síťové prvky a širší ekosystém AI infrastruktury. 3
10
Raptor je určen pro inference úlohy, kde záleží na zpoždění při generování tokenů. Akcelerátor zaměřený na paměť může být významný zejména při generování, kdy systém opakovaně přistupuje k vahám modelu. Platforma Nvidie má současně dodat komunikační a provozní základ potřebný pro nasazení v rackovém měřítku.
Spolupráce neznamená, že by Raptor měl nahrazovat GPU Nvidie ve všech typech AI zátěže. Vytváří spíše cestu k heterogenním systémům, kde specializovaný inference křemík funguje vedle infrastruktury Nvidie. Strategie NVLink Fusion je výslovně zaměřena na polozakázkovou AI infrastrukturu kombinující čipy partnerů s rackovými systémy a sítěmi Nvidie. 26
d-Matrix uvádí, že chce nabízet systémy s až 144 akcelerátory Raptor, propojenými jedinou plně propojenou strukturou NVLink. Cílové parametry jednoho racku jsou 2,3 TB 3D vrstvené DRAM a 7,2 PB/s agregované propustnosti paměti. Podle firmy by taková sestava měla podporovat modely s více než čtyřmi biliony parametrů při 4bitové přesnosti. 2
4
Tyto údaje je nutné chápat jako výhledové produktové cíle. Ve veřejně dostupných materiálech se liší popisy paměti a propustnosti na jeden akcelerátor, takže finální konfiguraci jednotlivých zařízení i reálně využitelnou kapacitu modelu bude nutné potvrdit blíže k uvedení produktu. Na velikost skutečně nasaditelného modelu mají vliv také paměť potřebná za běhu, metadata modelu, zvolený formát kvantizace a systémový software.
Raptor je popisován jako návrh kombinující 4nanometrový výpočetní čip s vlastní DRAM. d-Matrix očekává tape-out — dokončení návrhu pro výrobu — do konce roku 2026. První systémy integrované do racku mají být dostupné ve čtvrtém čtvrtletí roku 2027. 10
14
Jde tedy o víceletou spolupráci v rámci produktového plánu, nikoli o společný rackový produkt, který by se již dodával zákazníkům. 12
Otevřením své rackové platformy partnerským čipům může Nvidia oslovit zákazníky, kteří chtějí specializovaný křemík, aniž by se museli vzdát infrastrukturního stacku Nvidie. I když inference procesor dodá d-Matrix, navrhovaný systém může nadále používat NVLink, procesory, přepínače, DPU, SuperNIC, ethernetové síťování Spectrum-X i architekturu MGX od Nvidie. 3
10
Jde o závěr vyplývající z architektury systému, nikoli o zveřejněné informace o ekonomice dohody či dělení výnosů. Firmy finanční podmínky nezveřejnily. 1
Nvidia představila NVLink Fusion jako způsob, jak s partnery budovat polozakázkovou AI infrastrukturu. Mezi první veřejně oznámené partnery patřily MediaTek, Marvell, Alchip Technologies, Astera Labs, Synopsys a Cadence. Nvidia také uvedla, že přes tuto platformu lze s GPU Nvidie integrovat procesory Fujitsu a Qualcomm. 26
d-Matrix tento přístup rozšiřuje o XPU zaměřené na inference. Širší význam proto nespočívá jen v jednom čipu, ale v modulárnějším pojetí racku: zákazníci by potenciálně mohli kombinovat vlastní výpočetní křemík s propojovací a síťovou infrastrukturou Nvidie, místo aby volili mezi čistě nvidia konfigurací a zcela oddělenou platformou.
d-Matrix uvedla svůj inference akcelerátor Corsair v listopadu 2024. V listopadu 2025 firma oznámila financování Series C ve výši 275 milionů dolarů při ocenění 2 miliardy dolarů; celkové získané financování tím podle společnosti dosáhlo 450 milionů dolarů a mezi investory figuroval i fond M12 společnosti Microsoft. 28
39
Partnerství kolem Raptoru je proto pokusem posunout se od přístupu se samostatným inference akcelerátorem k modelu rackového nasazení. Zda se deklarované výhody v latenci, kapacitě a propustnosti promění v produkční nasazení, ukážou až finální čip, integrace softwaru a praktické benchmarky při plánovaném uvedení systémů v roce 2027.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix plánuje připojit inference XPUs Raptor přímo do rackových systémů Nvidia MGX přes NVLink Fusion, nikoli je nasazovat jen jako samostatné PCIe akcelerátory.
d Matrix plánuje připojit inference XPUs Raptor přímo do rackových systémů Nvidia MGX přes NVLink Fusion, nikoli je nasazovat jen jako samostatné PCIe akcelerátory. Návrh kombinuje Raptor s procesory Nvidia Vera, přepínači NVLink, DPU BlueField 4, síťovými kartami ConnectX 9 SuperNIC a ethernetem Spectrum X.
Společnost uvádí cíl až 144 akcelerátorů Raptor v jednom racku, s 2,3 TB 3D vrstvené DRAM a agregovanou propustností paměti 7,2 PB/s; jde o plánované parametry.