d Matrix dự kiến kết nối XPU suy luận Raptor thế hệ mới với NVLink Fusion và kiến trúc rack MGX của NVIDIA; thời điểm sẵn sàng ban đầu được nhắm tới là quý IV/2027. Thiết kế MGX dự kiến gồm CPU NVIDIA Vera, switch NVLink, DPU BlueField 4, SuperNIC ConnectX 9 và mạng Ethernet Spectrum X.
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion technology into its next-generation Raptor inference pro. Article summary: d-Matrix announced a multiyear roadmap partnership to design its next-generation Raptor inference XPUs for NVIDIA NVLink Fusion, beginning with integration into NVIDIA’s MGX rack reference architecture. The aim is a rack. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix công bố hợp tác theo lộ trình sản phẩm nhiều năm với NVIDIA, nhằm đưa XPU suy luận Raptor thế hệ tiếp theo vào hạ tầng AI của NVIDIA thông qua NVLink Fusion. Mục tiêu ban đầu là một hệ thống dựa trên kiến trúc tham chiếu rack NVIDIA MGX, phục vụ suy luận AI quy mô lớn với độ trễ cực thấp; thời điểm sẵn sàng đầu tiên được nhắm tới là quý IV/2027. 1
2
11
NVLink Fusion là nền tảng của NVIDIA cho phép CPU và bộ tăng tốc từ bên thứ ba kết nối vào mạng mở rộng theo chiều dọc (scale-up) NVLink, đồng thời kết hợp với hạ tầng AI rộng hơn của hãng. Theo kế hoạch, Raptor sẽ dùng NVLink cho kết nối scale-up và Spectrum-X Ethernet cho mạng mở rộng theo chiều ngang (scale-out). 1
Điểm đáng chú ý là d-Matrix có thể đưa chip suy luận tự thiết kế vào một mẫu rack NVIDIA đã được chuẩn hóa, thay vì phải tự xây dựng và kiểm định riêng toàn bộ nền tảng rack, mạng và làm mát. NVIDIA và d-Matrix cho rằng cách tiếp cận này có thể giảm rủi ro tích hợp và rút ngắn thời gian triển khai ở quy mô lớn. 1
2
d-Matrix cho biết hệ thống Raptor theo kiến trúc MGX mới nhất của NVIDIA sẽ tích hợp:
MGX là kiến trúc rack mô-đun của NVIDIA. Theo các bên, việc tích hợp này đưa Raptor vào hệ hạ tầng AI làm mát bằng chất lỏng đang được triển khai rộng rãi. 1
Thông báo hiện tại xác nhận khả năng tương thích với nền tảng rack quy mô lớn của NVIDIA, nhưng chưa xác lập một cấu hình Raptor thương mại hoàn chỉnh mang tên “NVL144”. Vì vậy, mọi con số về số lượng bộ tăng tốc hay băng thông bộ nhớ được nêu trước khi sản phẩm ra mắt nên được xem là mục tiêu lộ trình, không phải thông số đã triển khai hoặc được đo kiểm độc lập.
Trọng tâm của thỏa thuận là suy luận không đồng nhất: dùng các loại bộ xử lý khác nhau cho từng giai đoạn phục vụ mô hình AI tạo sinh.
Một cách phân chia phổ biến là để GPU xử lý prefill — giai đoạn tính toán nặng, khi mô hình tiếp nhận và xử lý prompt — còn bộ tăng tốc chuyên dụng đảm nhiệm decode, tức công đoạn nhạy cảm với độ trễ khi mô hình sinh từng token. d-Matrix định vị Raptor cho vai trò decode này. 18
19
Raptor là sản phẩm kế nhiệm của nền tảng Corsair đang được sản xuất. d-Matrix cho biết Raptor tiếp tục theo đuổi kiến trúc lấy bộ nhớ làm trung tâm, sử dụng phương pháp xếp chồng DRAM 3D để ghép một die bộ nhớ DRAM với một die tính toán SRAM trong cùng gói chip. Lập luận của hãng là việc đặt bộ nhớ và tính toán gần nhau hơn có thể phù hợp hơn với các tác vụ suy luận cần độ trễ thấp. 2
Vì thế, Raptor không được giới thiệu như sản phẩm thay thế toàn diện GPU. Nó được thiết kế như một thành phần chuyên biệt trong cụm suy luận dựa trên NVIDIA, nơi mỗi loại vi xử lý đảm nhiệm phần việc phù hợp với kiến trúc của mình.
Việc hỗ trợ XPU của d-Matrix qua NVLink Fusion mở rộng nhóm phần cứng có thể hoạt động trong hệ sinh thái kết nối, rack và hạ tầng AI của NVIDIA. Với khách hàng, lợi ích trực tiếp là khả năng triển khai bộ tăng tốc suy luận chuyên dụng trên thiết kế MGX đã được kiểm định, cùng NVLink và Spectrum-X, thay vì phải lắp ghép một môi trường tách biệt. 1
Đây là chiến lược nền tảng nhiều hơn là chỉ hợp tác chip. NVIDIA có thể giữ khách hàng trong hệ rack-scale của mình, trong khi silicon chuyên dụng xử lý một điểm nghẽn riêng của suy luận AI. Tuy nhiên, giá trị thương mại thực tế vẫn sẽ phụ thuộc vào phần mềm, giá thành, mức độ sẵn có và hiệu năng trên khối lượng công việc thực khi Raptor xuất xưởng.
d-Matrix dự kiến Raptor sẽ tape-out trước cuối năm 2026, còn rack MGX tích hợp Raptor được nhắm tới cho quý IV/2027. Đây là các mốc lộ trình có thể thay đổi. 9
11
Nền tảng Corsair hiện đã được đưa vào sản xuất. Trong một thông báo triển khai riêng, Parasail cho biết họ sẽ kết hợp Corsair với GPU NVIDIA Hopper và Blackwell: GPU xử lý prefill, còn Corsair xử lý decode. Parasail và d-Matrix tuyên bố khả năng sinh token nhanh hơn tới 10 lần; đây là tuyên bố hiệu năng của doanh nghiệp, không phải benchmark độc lập cho Raptor. 19
d-Matrix cũng cho biết đã huy động 275 triệu USD ở vòng Series C vào tháng 11/2025, đưa định giá công ty lên 2 tỷ USD và tổng vốn huy động lên 450 triệu USD. 16
Điểm quan trọng không chỉ là d-Matrix sử dụng một liên kết của NVIDIA. Raptor đang được định hướng để trở thành thành phần suy luận chuyên dụng ngay trong hệ rack MGX của NVIDIA. Nếu lộ trình được thực hiện đúng kế hoạch, các nhà vận hành có thể kết hợp CPU, mạng và GPU NVIDIA với một XPU lấy bộ nhớ làm trọng tâm cho giai đoạn decode, mà không cần dựng một nền tảng rack-scale độc lập từ đầu. 1
2
Hiện đây vẫn là lộ trình hướng đến năm 2027. Độ trễ, thông lượng và tổng chi phí sở hữu sẽ cần được đánh giá bằng phần cứng thương mại cùng các phép đo độc lập trên tác vụ suy luận thực tế.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
d Matrix dự kiến kết nối XPU suy luận Raptor thế hệ mới với NVLink Fusion và kiến trúc rack MGX của NVIDIA; thời điểm sẵn sàng ban đầu được nhắm tới là quý IV/2027.
d Matrix dự kiến kết nối XPU suy luận Raptor thế hệ mới với NVLink Fusion và kiến trúc rack MGX của NVIDIA; thời điểm sẵn sàng ban đầu được nhắm tới là quý IV/2027. Thiết kế MGX dự kiến gồm CPU NVIDIA Vera, switch NVLink, DPU BlueField 4, SuperNIC ConnectX 9 và mạng Ethernet Spectrum X.
Raptor vẫn là sản phẩm theo lộ trình, vì vậy hiệu năng, quy mô rack và thông số kỹ thuật trước khi ra mắt chưa phải kết quả được kiểm chứng độc lập.