d Matrix dự định dùng NVLink Fusion để đưa Raptor XPU thế hệ mới vào hạ tầng AI dựa trên MGX của Nvidia, thay vì phải xây một cụm tăng tốc hoàn toàn riêng. Thiết kế rack dự kiến kết hợp Vera CPU, switch NVLink, BlueField 4 DPU, ConnectX 9 SuperNIC và mạng Ethernet Spectrum X của Nvidia.
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix đang chọn một con đường để mở rộng suy luận AI mà không buộc khách hàng phải dựng cả một cụm máy tăng tốc độc lập. Công ty cho biết sẽ tích hợp NVLink Fusion của Nvidia vào Raptor — dòng XPU suy luận thế hệ tiếp theo — để kết nối chip này với kiến trúc rack MGX và nền tảng hạ tầng AI rộng hơn của Nvidia. Đây là lộ trình sản phẩm kéo dài nhiều năm; các Raptor XPU đầu tiên tích hợp trong rack MGX được kỳ vọng có mặt vào quý IV/2027. 1
8
NVLink Fusion là công nghệ liên kết và IP băng thông cao, độ trễ thấp của Nvidia, được thiết kế để đưa CPU và XPU tùy biến vào hạ tầng AI của hãng. Với d-Matrix, Raptor dự kiến có thể dùng mạng mở rộng theo chiều dọc NVLink (scale-up), mạng mở rộng theo chiều ngang Spectrum-X (scale-out), cùng thiết kế rack MGX, thay vì chỉ hoạt động trong một hệ thống đặt làm riêng. 1
14
Rack theo kế hoạch sẽ có Nvidia Vera CPU, switch NVLink, BlueField-4 DPU, ConnectX-9 SuperNIC và mạng Ethernet Spectrum-X. Theo d-Matrix, điều này giúp sản phẩm đi theo một lộ trình tích hợp đã được kiểm chứng, bao gồm rack, kết nối mạng, cấp nguồn, làm mát và chuỗi cung ứng — những phần việc mà nhà sản xuất chip tăng tốc tùy biến thường phải tự ghép nối. 1
8
Ý nghĩa thực tế nằm ở tích hợp cấp hệ thống. Một nhà vận hành trung tâm dữ liệu có thể dùng cùng cách tiếp cận hạ tầng định hướng Nvidia cho GPU, CPU lẫn XPU d-Matrix, thay vì phải thiết kế rack chuyên biệt cho từng loại vi xử lý. 1
Kiến trúc được đề xuất là suy luận tách rời (disaggregated inference): GPU Nvidia đảm nhiệm giai đoạn prefill nặng về tính toán, còn phần cứng chuyên dụng của d-Matrix hướng tới giai đoạn decode — tạo đầu ra theo từng token.
Nói đơn giản, prefill xử lý prompt đầu vào; decode tạo dòng token tiếp theo của câu trả lời. Cách phân chia này nhằm giao mỗi công đoạn cho loại phần cứng phù hợp hơn. Trước đó, Parasail từng cho biết họ sẽ triển khai các bộ tăng tốc Corsair hiện tại của d-Matrix cùng hệ thống Nvidia Hopper và Blackwell theo hướng phân tách prefill/decode tương tự. 22
Tuy nhiên, lợi ích hiệu năng vẫn phụ thuộc vào từng workload. Tuyên bố của Parasail về dịch vụ nhanh hơn và hiệu quả chi phí hơn tới 10 lần là tuyên bố từ công ty và đối tác cho một số workload chọn lọc, không phải phép so sánh độc lập có giá trị phổ quát giữa phần cứng d-Matrix và GPU. 22
d-Matrix cho biết rack Raptor đầu tiên sẽ theo kiến trúc tham chiếu MGX của Nvidia. Các báo cáo về lộ trình mô tả một thiết kế kiểu NVL144, hướng đến việc kết nối tối đa 144 bộ tăng tốc Raptor trong một fabric NVLink duy nhất; đây vẫn là kế hoạch tương lai, chưa phải cam kết thông số của sản phẩm đã xuất xưởng. 2
Mốc có tính cụ thể hơn là: Raptor XPU tích hợp vào rack Nvidia MGX dự kiến bắt đầu उपलब्ध vào quý IV/2027. 8
Do Raptor chưa phải sản phẩm MGX đang bán ra, khách hàng nên xem các chỉ số về hiệu năng, dung lượng và triển khai là mục tiêu lộ trình cho tới khi hệ thống hoàn chỉnh và benchmark có thể kiểm chứng độc lập xuất hiện.
Thoạt nhìn, việc mở cửa cho bộ xử lý suy luận bên thứ ba có thể khiến vai trò của Nvidia bị thu hẹp. Nhưng logic chiến lược có thể ngược lại: Nvidia muốn nền tảng AI của mình vẫn là nền móng được ưu tiên, ngay cả khi chip tính toán không phải GPU Nvidia.
NVLink Fusion giữ các lớp nền tảng có giá trị cao — fabric scale-up, mạng, kiến trúc rack và hạ tầng liên quan — trong hệ sinh thái Nvidia. Với d-Matrix và khách hàng, điều này có thể giảm rủi ro tích hợp và rút ngắn thời gian triển khai. Với Nvidia, nó làm giảm nhu cầu phải dựng một cụm hoàn toàn không dựa trên Nvidia. 1
14
Đó là ý nghĩa của cách Nvidia mô tả nền tảng của mình là “tích hợp theo chiều dọc và mở theo chiều ngang”.
Điều này không có nghĩa mọi bộ tăng tốc đều có thể thay thế hoàn toàn cho nhau hoặc có hiệu năng tương đương. Tính “có thể hoán đổi” trong bối cảnh này nên được hiểu là mục tiêu vận hành: nhà khai thác có thể lựa chọn tài nguyên tính toán phù hợp với workload trong khi vẫn dùng chung một nền hạ tầng.
Kế hoạch của d-Matrix có tính bổ trợ với GPU Nvidia trong mô hình chia tách prefill/decode, nhưng đồng thời cũng nằm trong cùng không gian chip suy luận chuyên xử lý decode với hệ thống Groq 3 LPU mà Nvidia lên kế hoạch. Nvidia từng giới thiệu Groq 3 LPX như một giải pháp decode chuyên dụng có thể ghép với hạ tầng Vera Rubin NVL72. 24
Vì vậy, Raptor có quan hệ kép với Nvidia: vừa bổ trợ cho GPU và dùng hạ tầng Nvidia, vừa có khả năng cạnh tranh với chính lựa chọn decode chuyên dụng của Nvidia. Thông tin hiện có chưa đủ để kết luận bên nào hơn bên nào về độ trễ, thông lượng, điện năng, giá hay thời điểm sẵn hàng.
d-Matrix cho biết vòng Series C vào tháng 11/2025 huy động 275 triệu USD, định giá công ty ở mức 2 tỷ USD, nâng tổng số vốn đã huy động lên 450 triệu USD. 27 Nền tảng suy luận hiện tại của công ty là Corsair; Raptor là XPU thế hệ kế tiếp được nêu trong lộ trình NVLink Fusion.
Corsair hiện là nền tảng trong hợp tác giữa d-Matrix và Parasail. Parasail nói sẽ triển khai bộ tăng tốc này bên cạnh hạ tầng Nvidia cho một số workload suy luận nhất định. Điểm đáng chú ý của Raptor là d-Matrix đang chuẩn bị một con đường trực tiếp hơn để đi vào môi trường rack quy mô lớn của Nvidia. 22
Hai công ty không tiết lộ điều khoản tài chính. Vì thế, thông tin công khai không xác lập mức phí bản quyền, cam kết mua tối thiểu, chi phí kỹ thuật, chia sẻ doanh thu hay bất kỳ điều kiện thương mại ưu đãi nào.
Do đó, nên xem đây là một lộ trình hạ tầng đáng chú ý: d-Matrix có đường đưa phần cứng decode chuyên dụng vào các AI factory dựa trên Nvidia, còn Nvidia mở rộng nhóm chip tính toán có thể dựa vào hệ sinh thái liên kết và rack của mình. Việc điều này có tạo ra lợi thế kinh tế suy luận ngoài thực tế hay không sẽ phụ thuộc vào phần cứng cuối cùng, mức độ tích hợp phần mềm, giá bán và các kết quả workload có thể tái lập độc lập. 1
8
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
d Matrix dự định dùng NVLink Fusion để đưa Raptor XPU thế hệ mới vào hạ tầng AI dựa trên MGX của Nvidia, thay vì phải xây một cụm tăng tốc hoàn toàn riêng.
d Matrix dự định dùng NVLink Fusion để đưa Raptor XPU thế hệ mới vào hạ tầng AI dựa trên MGX của Nvidia, thay vì phải xây một cụm tăng tốc hoàn toàn riêng. Thiết kế rack dự kiến kết hợp Vera CPU, switch NVLink, BlueField 4 DPU, ConnectX 9 SuperNIC và mạng Ethernet Spectrum X của Nvidia.
Mô hình suy luận tách rời nhắm tới việc để GPU xử lý prefill, còn Raptor đảm nhiệm decode từng token; hiệu quả thực tế vẫn phụ thuộc khối lượng công việc và phần cứng hoàn thiện.