NVLink Fusion membolehkan Raptor disepadukan ke dalam reka bentuk rak AI Nvidia, bukan digunakan sebagai pemecut PCIe yang berdiri sendiri. Raptor boleh menggunakan fabrik skala naik NVLink dalam rak, manakala Spectrum X menyediakan rangkaian skala keluar antara rak atau sistem.
Diterbitkan olehImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: How does d Matrix’s adoption of Nvidia’s NVLink Fusion for its next generation Raptor inference processors enable the startup to plug its me. Article summary: d Matrix is using NVLink Fusion to make Raptor a native, rack scale participant in Nvidia’s AI factory design rather than a separate PCIe inference card.. Topic tags: general web, llm, ai, code, benchmarks. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layou
d-Matrix menggunakan NVLink Fusion supaya Raptor bukan sekadar pemecut inferens yang dipasang berasingan melalui PCIe. Sebaliknya, XPU Raptor—pemproses khusus untuk inferens AI—dirancang untuk dihubungkan terus ke dalam seni bina rak pusat data Nvidia yang disejukkan cecair, termasuk reka bentuk rujukan MGX/NVL144. Ini meletakkan cip berfokus memori d-Matrix dalam sistem berskala rak yang menggunakan fabrik, rangkaian dan perkakasan pengurusan Nvidia. 3
5
Raptor akan melaksanakan antara muka NVLink Fusion, yang membolehkan cip tersuai mengambil bahagian dalam sambungan berkelajuan tinggi Nvidia. Dalam rak, NVLink berfungsi sebagai fabrik scale-up—iaitu sambungan berlebar jalur tinggi dan berlatensi rendah antara pemproses dalam satu sistem. Untuk memperluas sistem melangkaui rak, Nvidia menyediakan rangkaian scale-out Spectrum-X. 3
5
Dengan kata lain, d-Matrix membekalkan XPU untuk tugasan inferens tertentu, manakala Nvidia terus membekalkan banyak komponen asas sistem pusat data dan reka bentuk integrasinya.
Menurut pelan integrasi yang diumumkan, reka bentuk rujukan rak Nvidia untuk Raptor boleh menggabungkan:
Astera Labs juga disebut sebagai rakan ekosistem NVLink Fusion yang akan membantu menyediakan penyelesaian sambungan tersuai bagi memastikan aliran data berdaya pemprosesan tinggi dalam sistem. 6
Dalam model bahasa besar, inferens lazimnya melibatkan dua fasa utama. Fasa prefill memproses prompt awal, manakala fasa decode menjana jawapan token demi token. d-Matrix menyasarkan fasa decode yang peka terhadap kependaman, kerana proses ini perlu membaca pemberat model berulang kali dan menjadikan kapasiti serta lebar jalur memori sangat penting. 3
10
Ini bukan semestinya bermaksud Raptor menggantikan GPU Nvidia sepenuhnya. Pendekatan yang dimaksudkan ialah saluran kerja pelengkap: GPU kekal berguna untuk prefill dan pengkomputeran umum, manakala XPU d-Matrix menyasarkan penyahkodan token yang pantas. 3
10
d-Matrix menyatakan sasaran sistemnya ialah sehingga 144 Raptor XPU dalam satu rak, dipautkan melalui fabrik NVLink semua-ke-semua. Pada peringkat rak, syarikat itu menyasarkan kira-kira 2.3 TB memori DRAM bertindan 3D dan 7.2 PB/s lebar jalur memori agregat. 3
7
Laporan mengenai Raptor turut menyebut 32 GB DRAM bertindan 3D dan sehingga 100 TB/s lebar jalur memori bagi setiap pemecut/kad Raptor. Butiran konfigurasi akhir, termasuk cara kapasiti dipetakan pada peringkat rak, masih perlu dinilai apabila produk sebenar tersedia. 3
7
12
d-Matrix berkata kapasiti rak tersebut secara teori boleh memuatkan model melebihi empat trilion parameter pada ketepatan 4-bit. Namun, saiz model yang benar-benar boleh digunakan akan bergantung pada metadata, keadaan masa jalan, format model dan overhed perisian. 3
Raptor digambarkan menggunakan die pengkomputeran 4 nm yang digabungkan dengan DRAM tersuai. d-Matrix menjangka cip itu mencapai peringkat tape-out menjelang akhir 2026, manakala sistem rak MGX bersepadu pertama dijangka tersedia pada suku keempat 2027. 10
4
Bagi Nvidia, NVLink Fusion membolehkan pelanggan menggunakan pemecut khusus pihak ketiga tanpa perlu meninggalkan keseluruhan ekosistem rak Nvidia. Dalam senario ini, Nvidia masih boleh menyediakan seni bina rak, fabrik NVLink, suis, CPU, DPU, SuperNIC, rangkaian Ethernet dan infrastruktur berkaitan perisian—walaupun silikon inferens utama bukan GPU Nvidia.
Ini ialah tafsiran berdasarkan seni bina dan model komersial yang diumumkan, bukannya kenyataan Nvidia atau d-Matrix tentang nilai ekonomi perjanjian tersebut. 3
5
d-Matrix menyertai ekosistem NVLink Fusion yang turut dikaitkan secara terbuka dengan rakan seperti AWS, Arm, Intel, Fujitsu, MediaTek dan Marvell. Arah strateginya adalah menjadikan NVLink sebagai antara muka platform untuk perkakasan AI heterogen, bukan hanya sambungan antara GPU Nvidia. 3
d-Matrix melancarkan pemecut inferens Corsair pada November 2024. Syarikat itu kemudian memperoleh pusingan Siri C bernilai AS$275 juta pada penilaian AS$2 bilion, dengan penyertaan M12 Microsoft antara pelabur terdahulu; laporan yang sama menyatakan jumlah pembiayaan terkumpulnya sekitar AS$450 juta. Kedua-dua angka itu tidak wajar dianggap sebagai satu pusingan pembiayaan AS$450 juta. 2
Syarat kewangan kerjasama d-Matrix–Nvidia tidak didedahkan. 1
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
NVLink Fusion membolehkan Raptor disepadukan ke dalam reka bentuk rak AI Nvidia, bukan digunakan sebagai pemecut PCIe yang berdiri sendiri.
NVLink Fusion membolehkan Raptor disepadukan ke dalam reka bentuk rak AI Nvidia, bukan digunakan sebagai pemecut PCIe yang berdiri sendiri. Raptor boleh menggunakan fabrik skala naik NVLink dalam rak, manakala Spectrum X menyediakan rangkaian skala keluar antara rak atau sistem.
Reka bentuk rujukan MGX dijangka merangkumi CPU Vera, suis NVLink, DPU BlueField 4, SuperNIC ConnectX 9 dan Ethernet Spectrum X daripada Nvidia.