d Matrix dự kiến dùng NVLink Fusion để đưa Raptor XPU vào hệ thống AI quy mô rack MGX của Nvidia, thay vì chỉ triển khai như bộ tăng tốc PCIe độc lập. Thiết kế tham chiếu kết hợp Raptor với CPU Vera, switch NVLink, DPU BlueField 4, ConnectX 9 SuperNIC và mạng Ethernet Spectrum X của Nvidia.
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: How does d-Matrix’s adoption of Nvidia’s NVLink Fusion for its next-generation Raptor inference processors enable the startup to plug its me. Article summary: d-Matrix is using NVLink Fusion to make Raptor a native, rack-scale participant in Nvidia’s AI-factory design rather than a separate PCIe inference card. That gives customers a memory-centric accelerator for latency-sens. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
d-Matrix đang chọn con đường tích hợp thay vì đứng ngoài hệ sinh thái Nvidia: XPU suy luận thế hệ mới Raptor được dự kiến kết nối trực tiếp vào hạ tầng AI quy mô rack của Nvidia thông qua NVLink Fusion. Điều này có nghĩa Raptor không chỉ là một card tăng tốc gắn thêm theo mô hình máy chủ truyền thống, mà được thiết kế để trở thành một thành phần trong rack AI dùng kiến trúc MGX, kết hợp với kết nối liên chip và mạng mà Nvidia đã xây dựng. 3
10
NVLink Fusion là nền tảng của Nvidia nhằm đưa silicon do đối tác phát triển vào hạ tầng AI của hãng. Với d-Matrix, nền tảng này mở đường để Raptor kết nối với mạng mở rộng bên trong hệ thống (scale-up) NVLink, kiến trúc rack MGX và mạng mở rộng giữa các rack (scale-out) Spectrum-X. Nvidia cho biết cách tiếp cận này giúp các đối tác triển khai silicon tùy biến ở quy mô lớn nhanh hơn và ít rủi ro hơn, vì có thể dựa trên một hệ sinh thái rack đã được kiểm chứng thay vì tự ghép toàn bộ hệ thống từ đầu. 3
Khác biệt cốt lõi là Raptor được lên kế hoạch nằm trong một rack theo thiết kế tham chiếu MGX. Như vậy, d-Matrix không đơn thuần bán một bộ tăng tốc rời, mà tham gia vào một hệ thống quy mô rack có fabric băng thông cao dùng chung và bộ thành phần hạ tầng xác định rõ ràng. 3
10
Theo kế hoạch, thiết kế dựa trên Raptor sẽ dùng các thành phần sau trong nền tảng Nvidia:
d-Matrix cũng hợp tác với Astera Labs để phát triển các giải pháp kết nối tùy chỉnh, hướng tới luồng dữ liệu thông suốt và thông lượng cao trong hệ thống. 10
Cách phân vai này có ý nghĩa chiến lược: d-Matrix cung cấp XPU chuyên cho suy luận, còn Nvidia đảm nhiệm phần lớn nền tảng bao quanh — kiến trúc tham chiếu, kết nối scale-up, thiết bị mạng và hệ sinh thái hạ tầng AI rộng hơn. 3
10
Raptor được định vị cho các tác vụ suy luận mà độ trễ sinh token là yếu tố quan trọng. Một bộ tăng tốc lấy bộ nhớ làm trung tâm có thể đặc biệt phù hợp với quá trình sinh nội dung, khi mô hình phải truy cập lặp lại các trọng số; trong khi đó, nền tảng Nvidia cung cấp nền tảng truyền thông và triển khai cần thiết để vận hành ở cấp độ rack.
Thỏa thuận này không đồng nghĩa Raptor sẽ thay thế GPU Nvidia trong mọi loại tác vụ AI. Đúng hơn, nó tạo ra một lộ trình cho hệ thống dị thể: silicon chuyên biệt cho suy luận có thể cùng tồn tại với hạ tầng Nvidia. Chiến lược NVLink Fusion của Nvidia vốn nhắm đến hạ tầng AI bán tùy biến, kết hợp chip của đối tác với hệ thống và mạng quy mô rack của Nvidia. 26
d-Matrix cho biết họ kỳ vọng cung cấp hệ thống với tối đa 144 bộ tăng tốc Raptor, kết nối qua một fabric NVLink all-to-all duy nhất. Mục tiêu ở cấp rack mà công ty công bố là 2,3 TB DRAM xếp chồng 3D cùng 7,2 PB/s băng thông bộ nhớ tổng, hướng tới khả năng hỗ trợ các mô hình vượt 4 nghìn tỷ tham số ở độ chính xác 4-bit. 2
4
Đây là các mục tiêu sản phẩm mang tính dự báo. Các mô tả công khai về dung lượng và băng thông trên từng bộ tăng tốc hiện chưa hoàn toàn đồng nhất, vì vậy cấu hình cuối cùng của mỗi thiết bị và dung lượng mô hình có thể triển khai thực tế sẽ cần chờ xác nhận gần thời điểm ra mắt. Bộ nhớ thời gian chạy, siêu dữ liệu mô hình, định dạng lượng tử hóa và phần mềm hệ thống đều ảnh hưởng đến quy mô mô hình có thể vận hành.
Raptor được mô tả là thiết kế ghép một die tính toán tiến trình 4 nm với DRAM tùy chỉnh. d-Matrix dự kiến hoàn tất tape-out — giai đoạn chốt thiết kế để gửi đi sản xuất — trước cuối năm 2026; các hệ thống tích hợp cấp rack đầu tiên được kỳ vọng có mặt vào quý IV/2027. 10
14
Vì thế, đây là hợp tác theo lộ trình sản phẩm nhiều năm, chưa phải một sản phẩm rack chung đang được xuất xưởng. 12
Việc mở nền tảng rack cho chip đối tác giúp Nvidia phục vụ những khách hàng muốn dùng silicon chuyên biệt mà không phải rời bỏ toàn bộ hạ tầng Nvidia. Dù bộ xử lý suy luận do d-Matrix cung cấp, hệ thống đề xuất vẫn có thể dùng fabric NVLink, CPU, switch, DPU, SuperNIC, mạng Ethernet Spectrum-X và kiến trúc MGX của Nvidia. 3
10
Đây là hệ quả có thể suy ra từ kiến trúc hệ thống, không phải tuyên bố công khai về cơ chế chia sẻ doanh thu hay hiệu quả tài chính của thương vụ. Các bên không công bố điều khoản tài chính. 1
Nvidia giới thiệu NVLink Fusion để hỗ trợ hạ tầng AI bán tùy biến cùng các đối tác. Danh sách đối tác công khai ban đầu gồm MediaTek, Marvell, Alchip Technologies, Astera Labs, Synopsys và Cadence; Nvidia cũng cho biết CPU của Fujitsu và Qualcomm có thể được tích hợp với GPU Nvidia qua nền tảng này. 26
d-Matrix mở rộng mô hình đó sang XPU tập trung vào suy luận. Ý nghĩa lớn hơn không chỉ nằm ở một con chip: khách hàng có thể có thêm lựa chọn kết hợp phần cứng tính toán tùy biến với hạ tầng liên kết và mạng của Nvidia, thay vì phải chọn giữa một hệ thống hoàn toàn của Nvidia hoặc một nền tảng tách biệt hoàn toàn.
d-Matrix ra mắt bộ tăng tốc suy luận Corsair vào tháng 11/2024. Đến tháng 11/2025, công ty cho biết đã huy động 275 triệu USD ở vòng Series C với mức định giá 2 tỷ USD, nâng tổng vốn huy động lên 450 triệu USD; quỹ M12 của Microsoft là một trong các nhà đầu tư. 28
39
Quan hệ đối tác Raptor vì vậy là nỗ lực đưa d-Matrix từ mô hình bộ tăng tốc suy luận rời sang mô hình triển khai ở cấp rack. Các lợi thế hứa hẹn về độ trễ, dung lượng và băng thông chỉ có thể được kiểm chứng khi silicon hoàn thiện, phần mềm tích hợp xong và hệ thống bước vào các thử nghiệm thực tế trong lộ trình năm 2027.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
d Matrix dự kiến dùng NVLink Fusion để đưa Raptor XPU vào hệ thống AI quy mô rack MGX của Nvidia, thay vì chỉ triển khai như bộ tăng tốc PCIe độc lập.
d Matrix dự kiến dùng NVLink Fusion để đưa Raptor XPU vào hệ thống AI quy mô rack MGX của Nvidia, thay vì chỉ triển khai như bộ tăng tốc PCIe độc lập. Thiết kế tham chiếu kết hợp Raptor với CPU Vera, switch NVLink, DPU BlueField 4, ConnectX 9 SuperNIC và mạng Ethernet Spectrum X của Nvidia.
d Matrix đặt mục tiêu cho rack 144 Raptor đạt 2,3 TB DRAM xếp chồng 3D và 7,2 PB/s băng thông bộ nhớ tổng; đây là các chỉ tiêu sản phẩm do công ty công bố.