d Matrix merancang memasukkan XPU inferens Raptor terus ke dalam sistem rak berskala NVIDIA MGX menerusi NVLink Fusion, bukan sekadar menjual pemecut PCIe berasingan. Reka bentuk itu akan menggunakan CPU NVIDIA Vera, suis NVLink, DPU BlueField 4, ConnectX 9 SuperNIC dan rangkaian Ethernet Spectrum X.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does d-Matrix’s adoption of Nvidia’s NVLink Fusion for its next-generation Raptor inference processors enable the startup to plug its me. Article summary: d-Matrix is using NVLink Fusion to make Raptor a native, rack-scale participant in Nvidia’s AI-factory design rather than a separate PCIe inference card. That gives customers a memory-centric accelerator for latency-sens. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
d-Matrix mahu menjadikan Raptor sebahagian daripada sistem AI NVIDIA pada aras rak, bukannya sekadar kad pemecut yang dipasang secara berasingan melalui laluan pengembangan pelayan biasa. Menerusi NVLink Fusion, cip inferens Raptor yang menumpukan seni bina memori boleh dihubungkan terus dengan infrastruktur AI NVIDIA yang sedia ada. 3
10
NVLink Fusion ialah platform NVIDIA untuk membawa silikon rakan kongsi ke dalam infrastruktur AI berasaskan NVIDIA. Bagi d-Matrix, ia membuka laluan untuk menyambungkan Raptor kepada rangkaian scale-up NVLink, seni bina rak MGX dan rangkaian scale-out Spectrum-X. Dalam istilah mudah, scale-up merujuk kepada sambungan berkelajuan tinggi antara komponen dalam sistem, manakala scale-out membantu sistem berkembang merentasi lebih banyak pelayan atau rak. 3
Raptor dirancang untuk digunakan dalam rak berasaskan reka bentuk rujukan MGX. Ini penting kerana d-Matrix tidak perlu membina keseluruhan ekosistem rak, fabrik sambungan dan rangkaian dari awal; ia boleh memanfaatkan reka bentuk rak NVIDIA yang telah disahkan. 3
10
Sistem berasaskan Raptor yang dirancang itu akan menggabungkan komponen berikut:
Selain itu, d-Matrix bekerjasama dengan Astera Labs bagi penyelesaian sambungan tersuai untuk menyokong aliran data berkapasiti tinggi dalam sistem tersebut. 10
Pembahagian tugasnya jelas: d-Matrix menyumbang XPU inferens, sementara NVIDIA menyediakan sebahagian besar lapisan di sekelilingnya — seni bina rujukan, fabrik sambungan, komponen rangkaian dan ekosistem infrastruktur AI. 3
10
Raptor diposisikan untuk tugasan inferens yang sensitif kepada kependaman ketika token dijana. Dalam model bahasa besar, proses menjana token satu demi satu memerlukan capaian berulang kepada pemberat model. Oleh itu, pemecut yang menumpukan memori boleh menjadi relevan untuk bahagian beban kerja ini, manakala platform NVIDIA menyediakan asas komunikasi dan penggunaan pada skala rak.
Kerjasama ini tidak bermaksud Raptor menggantikan GPU NVIDIA untuk semua tugasan AI. Sebaliknya, ia mewujudkan laluan bagi sistem heterogen — cip inferens khusus boleh beroperasi bersama infrastruktur NVIDIA. Strategi NVLink Fusion NVIDIA memang direka untuk infrastruktur AI separa tersuai yang menggabungkan silikon rakan kongsi dengan sistem dan rangkaian aras rak NVIDIA. 26
d-Matrix menyatakan bahawa ia menyasarkan sistem dengan sehingga 144 pemecut Raptor yang dihubungkan melalui satu fabrik NVLink semua-ke-semua. Pada aras rak, sasaran yang diumumkan ialah 2.3 TB DRAM bertindan 3D dan 7.2 PB/s lebar jalur memori agregat, bagi menyokong model yang melebihi empat trilion parameter pada ketepatan 4-bit. 2
4
Angka ini ialah sasaran produk yang bersifat pandang ke hadapan, bukannya prestasi produk yang telah tersedia di pasaran. Penerangan awam juga berbeza-beza tentang memori dan lebar jalur bagi setiap pemecut. Konfigurasi akhir peranti serta kapasiti model yang benar-benar boleh digunakan perlu disahkan apabila produk semakin hampir dilancarkan, kerana memori masa jalan, metadata model, format kuantisasi dan perisian sistem semuanya mempengaruhi kapasiti sebenar.
Raptor digambarkan sebagai reka bentuk yang menggabungkan die pengkomputeran 4 nanometer dengan DRAM tersuai. d-Matrix menjangkakan proses tape-out — penyerahan reka bentuk cip akhir untuk pembuatan — selesai menjelang akhir 2026. Sistem pertama yang diintegrasi ke dalam rak dijangka tersedia pada suku keempat 2027. 10
14
Ini bermakna pengumuman tersebut ialah kerjasama pelan hala tuju produk berbilang tahun, bukannya produk rak bersama yang sudah dihantar kepada pelanggan hari ini. 12
Dengan membuka platform aras raknya kepada cip rakan kongsi, NVIDIA boleh memenuhi keperluan pelanggan yang mahukan silikon khusus tanpa memaksa mereka meninggalkan ekosistem infrastrukturnya. Walaupun pemproses inferens datang daripada d-Matrix, sistem yang dicadangkan masih boleh menggunakan fabrik NVLink, CPU, suis, DPU, SuperNIC, rangkaian Ethernet Spectrum-X dan seni bina MGX NVIDIA. 3
10
Secara seni bina, langkah ini membolehkan NVIDIA kekal sebagai pembekal penting bagi lapisan sistem di sekeliling pemecut pihak ketiga. Namun, ini ialah implikasi daripada reka bentuk platform, bukan kenyataan rasmi tentang pembahagian hasil atau ekonomi perjanjian. Syarat kewangan kerjasama itu tidak didedahkan. 1
NVIDIA memperkenalkan NVLink Fusion untuk membolehkan infrastruktur AI separa tersuai bersama rakan kongsi. Antara rakan kongsi awal yang diumumkan secara terbuka ialah MediaTek, Marvell, Alchip Technologies, Astera Labs, Synopsys dan Cadence. NVIDIA juga berkata CPU daripada Fujitsu dan Qualcomm boleh diintegrasikan dengan GPU NVIDIA menerusi platform itu. 26
Kemasukan d-Matrix memperluas pendekatan itu kepada XPU yang memfokuskan inferens. Kepentingan lebih besarnya bukan semata-mata pada satu cip: pelanggan berpotensi mencampurkan silikon pengkomputeran tersuai dengan sambungan serta rangkaian NVIDIA, tanpa perlu memilih antara sistem serba NVIDIA atau platform yang terpisah sepenuhnya.
d-Matrix melancarkan pemecut inferens Corsair pada November 2024. Pada November 2025, syarikat itu berkata ia mengumpulkan AS$275 juta dalam pusingan Siri C pada penilaian AS$2 bilion, menjadikan jumlah pembiayaan terkumpulnya AS$450 juta; M12 milik Microsoft merupakan antara pelabur. 28
39
Kerjasama Raptor ini ialah percubaan d-Matrix untuk beralih daripada pendekatan pemecut inferens diskret kepada model penggunaan pada skala rak. Sama ada kelebihan kependaman, kapasiti dan lebar jalur yang dijanjikan dapat diterjemahkan kepada penggunaan pengeluaran sebenar akan bergantung pada silikon akhir, integrasi perisian dan penanda aras dunia sebenar apabila sistem yang dirancang itu tiba pada 2027.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix merancang memasukkan XPU inferens Raptor terus ke dalam sistem rak berskala NVIDIA MGX menerusi NVLink Fusion, bukan sekadar menjual pemecut PCIe berasingan.
d Matrix merancang memasukkan XPU inferens Raptor terus ke dalam sistem rak berskala NVIDIA MGX menerusi NVLink Fusion, bukan sekadar menjual pemecut PCIe berasingan. Reka bentuk itu akan menggunakan CPU NVIDIA Vera, suis NVLink, DPU BlueField 4, ConnectX 9 SuperNIC dan rangkaian Ethernet Spectrum X.
d Matrix menyasarkan satu rak dengan sehingga 144 Raptor, 2.3 TB DRAM bertindan 3D dan 7.2 PB/s lebar jalur memori agregat; semuanya masih sasaran produk syarikat.