d Matrix merancang untuk menyambungkan XPU inferens Raptor generasi akan datang ke NVLink Fusion NVIDIA dan seni bina rak MGX, dengan ketersediaan awal sistem rak disasarkan pada suku keempat 2027. Reka bentuk MGX yang dicadangkan merangkumi CPU NVIDIA Vera, suis NVLink, DPU BlueField 4, SuperNIC ConnectX 9 serta Et...
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion technology into its next-generation Raptor inference pro. Article summary: d-Matrix announced a multiyear roadmap partnership to design its next-generation Raptor inference XPUs for NVIDIA NVLink Fusion, beginning with integration into NVIDIA’s MGX rack reference architecture. The aim is a rack. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix mengumumkan kerjasama peta jalan produk berbilang tahun dengan NVIDIA untuk menyepadukan XPU inferens Raptor yang akan datang dengan NVIDIA NVLink Fusion. Pelaksanaan pertama yang dirancang ialah sistem berasaskan Raptor dalam seni bina rujukan rak MGX NVIDIA, bagi beban kerja inferens AI berskala besar dan berlengah amat rendah. Ketersediaan awal Raptor dalam rak MGX disasarkan pada suku keempat 2027. 1
2
11
NVLink Fusion ialah platform NVIDIA untuk menghubungkan CPU dan pemecut pihak ketiga ke rangkaian scale-up NVLink serta infrastruktur AI yang lebih luas. Dalam kerjasama ini, d-Matrix bercadang menyambungkan XPU Raptor melalui NVLink, manakala Ethernet Spectrum-X digunakan untuk rangkaian scale-out antara sistem. 1
Secara praktikal, pendekatan ini membolehkan d-Matrix memasukkan silikon inferens tersuainya ke dalam reka bentuk rak NVIDIA yang sudah mantap, tanpa perlu membangunkan dan mengesahkan platform rak, rangkaian serta penyejukan yang berasingan dari awal. NVIDIA dan d-Matrix menyifatkannya sebagai laluan yang lebih pantas dan kurang berisiko daripada silikon tersuai ke penggunaan berskala besar. 1
2
Sistem Raptor yang dirancang akan menggunakan seni bina rujukan MGX terkini NVIDIA. Menurut d-Matrix, reka bentuk itu akan merangkumi:
MGX ialah seni bina rak modular. NVIDIA menyatakan integrasi itu akan meletakkan Raptor dalam infrastruktur AI sejukan cecair yang digunakan secara meluas. 1
Pengumuman ini menyokong kesalingoperasian dengan platform berskala rak NVIDIA, tetapi pengumuman syarikat yang dirujuk tidak mengesahkan konfigurasi Raptor yang telah dimuktamadkan dan dipasarkan khusus sebagai sistem “NVL144”. Oleh itu, sebarang angka melibatkan 144 pemecut atau lebar jalur memori yang dilaporkan sebelum pelancaran perlu dianggap sebagai unjuran peta jalan, bukannya spesifikasi perkakasan yang telah digunakan atau diuji secara bebas.
Kerjasama ini tertumpu pada inferens heterogen, iaitu pembahagian tugas penyajian model AI generatif antara jenis pemproses berlainan.
Lazimnya, GPU digunakan untuk prefill — fasa pengiraan berat apabila model memproses arahan atau input pengguna. Pemecut khusus pula boleh menangani decode, iaitu fasa sensitif kependaman apabila model menjana token satu demi satu. d-Matrix meletakkan Raptor sebagai pemecut untuk peranan decode ini. 18
19
Raptor ialah susulan kepada platform Corsair d-Matrix yang kini sudah dalam pengeluaran, dan meneruskan reka bentuk berpusatkan memori syarikat itu. d-Matrix berkata Raptor menggunakan pendekatan susunan DRAM 3D yang menghimpunkan cip memori DRAM dan cip pengiraan SRAM dalam satu pakej. Premisnya ialah jarak lebih rapat antara memori dengan pengiraan dapat membantu beban kerja inferens yang memerlukan kependaman rendah. 2
Ini bermaksud Raptor tidak diposisikan sebagai pengganti menyeluruh untuk GPU. Sebaliknya, ia disasarkan sebagai komponen khusus dalam kluster inferens berasaskan NVIDIA, dengan setiap pemproses menjalankan tugasan yang paling sepadan dengan seni binanya.
Bagi NVIDIA, sokongan terhadap XPU pihak ketiga melalui NVLink Fusion meluaskan jenis perkakasan yang boleh beroperasi dalam ekosistem rangkaian, rak dan infrastruktur AI syarikat itu. Bagi pelanggan, tarikan utamanya ialah penyepaduan: pemecut inferens khusus boleh digunakan bersama reka bentuk MGX yang disahkan, sambungan NVLink dan rangkaian Spectrum-X, tanpa perlu dibina sebagai persekitaran berasingan. 1
Jadi, pengaturan ini merupakan strategi platform selain kerjasama cip. NVIDIA dapat mengekalkan pembeli infrastruktur dalam asas berskala raknya, sambil membenarkan silikon khusus menangani kekangan inferens tertentu. Namun, nilai komersial sebenar akan bergantung pada ketersediaan perkakasan, sokongan perisian, kos dan prestasi bagi beban kerja sebenar apabila Raptor dihantar kelak.
d-Matrix menjangka Raptor mencapai peringkat tape-out — reka bentuk cip dimuktamadkan untuk pembuatan — menjelang akhir 2026, dan menyasarkan ketersediaan awal rak MGX pada suku keempat 2027. Tarikh ini ialah sasaran peta jalan yang berpandangan ke hadapan dan boleh berubah. 9
11
Platform XPU Corsair semasa d-Matrix sudah berada dalam pengeluaran. Dalam pengumuman penggunaan yang berasingan, Parasail berkata ia akan menggandingkan pemecut Corsair dengan GPU NVIDIA Hopper dan Blackwell, menggunakan GPU bagi prefill dan Corsair bagi decode. Parasail serta d-Matrix mendakwa penjanaan token boleh menjadi sehingga 10 kali lebih pantas; itu ialah dakwaan prestasi daripada syarikat, bukan penanda aras bebas untuk Raptor. 19
d-Matrix turut melaporkan pembiayaan Siri C sebanyak AS$275 juta pada November 2025. Pembiayaan itu menilai syarikat tersebut pada AS$2 bilion dan menjadikan jumlah pembiayaannya setakat itu AS$450 juta. 16
Perkembangan utama bukan sekadar d-Matrix menggunakan sambung kait NVIDIA. Raptor sedang direka untuk masuk ke ekosistem rak MGX NVIDIA sebagai komponen inferens yang dibina khusus. Jika peta jalan ini dilaksanakan, pengendali boleh menggabungkan CPU, rangkaian dan GPU NVIDIA dengan XPU berpusatkan memori untuk fasa decode penyajian AI — tanpa membina platform berskala rak yang berasingan dari awal. 1
2
Buat masa ini, ia masih sebuah peta jalan dengan sasaran ketersediaan pada 2027. Cadangan nilainya perlu dinilai melalui perkakasan yang benar-benar dihantar, beban kerja inferens sebenar serta ukuran bebas bagi kependaman, daya pemprosesan dan jumlah kos pemilikan.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
d Matrix merancang untuk menyambungkan XPU inferens Raptor generasi akan datang ke NVLink Fusion NVIDIA dan seni bina rak MGX, dengan ketersediaan awal sistem rak disasarkan pada suku keempat 2027.
d Matrix merancang untuk menyambungkan XPU inferens Raptor generasi akan datang ke NVLink Fusion NVIDIA dan seni bina rak MGX, dengan ketersediaan awal sistem rak disasarkan pada suku keempat 2027. Reka bentuk MGX yang dicadangkan merangkumi CPU NVIDIA Vera, suis NVLink, DPU BlueField 4, SuperNIC ConnectX 9 serta Ethernet Spectrum X.
Raptor masih produk masa hadapan; prestasi dan spesifikasi skala raknya ialah sasaran peta jalan syarikat, bukannya keputusan yang telah disahkan secara bebas.