d Matrix는 Raptor 추론 XPU를 엔비디아 NVLink Fusion으로 연결해 MGX 기반 AI 인프라에 배치하는 다년 제품 로드맵을 발표했다. 구성에는 Vera CPU, NVLink 스위치, BlueField 4 DPU, ConnectX 9 SuperNIC, Spectrum X 이더넷이 포함될 예정이다.
게시자GPT-5.6 Terra로 편집GPT Image 2로 이미지 생성
연구 답변

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix가 차세대 AI 추론 칩 Raptor XPU를 엔비디아의 랙 단위 인프라에 연결하는 길을 택했다. 회사는 엔비디아 NVLink Fusion을 채택해 Raptor를 MGX 랙 아키텍처와 엔비디아 AI 인프라 플랫폼에 통합하겠다고 밝혔다. 양사는 이를 다년간의 제품 로드맵으로 설명하며, Raptor XPU가 통합된 초기 MGX 랙의 제공 시점은 2027년 4분기로 예상한다. 1
8
NVLink Fusion은 맞춤형 CPU와 XPU를 엔비디아 AI 인프라에 연결하기 위한 고대역폭·저지연 인터커넥트 기술 및 IP다. d-Matrix는 이를 통해 Raptor를 NVLink 스케일업 네트워킹, Spectrum-X 스케일아웃 네트워킹, MGX 랙 설계에 연결할 계획이다. 1
14
예정된 랙에는 엔비디아 Vera CPU, NVLink 스위치, BlueField-4 DPU, ConnectX-9 SuperNIC, Spectrum-X 이더넷이 들어간다. d-Matrix 입장에서는 전력·냉각·네트워킹·랙 설계와 공급망을 별도로 처음부터 맞추는 대신, 엔비디아의 검증된 인프라 경로를 활용할 수 있다는 의미다. 1
8
즉, 이번 발표는 서버에 가속기 하나를 추가하는 수준이 아니다. 데이터센터 운영자가 GPU, CPU, d-Matrix XPU를 각각 전용 랙으로 구성하지 않고도, 엔비디아 중심의 공통 인프라 토대에서 운영할 수 있게 하려는 구상이다. 1
d-Matrix가 제시하는 구조는 분리형 추론(disaggregated inference) 이다. 엔비디아 GPU가 입력 프롬프트를 처리하는 연산 집약적 프리필(prefill) 단계를 맡고, Raptor 같은 전용 하드웨어는 출력 토큰을 한 개씩 생성하는 디코드(decode) 단계에 초점을 맞춘다.
프리필은 사용자의 질문이나 입력 문맥을 모델이 처리하는 과정이며, 디코드는 답변을 토큰 단위로 이어서 생성하는 과정이다. 각 프로세서가 자신에게 적합한 작업을 분담하도록 하겠다는 접근이다.
d-Matrix는 앞서 Parasail이 현행 Corsair 가속기를 엔비디아 Hopper·Blackwell 시스템과 함께 배치하는 방식도 발표했다. Parasail은 선택된 워크로드에서 최대 10배 더 빠르고 비용 효율적인 추론 서비스를 제공할 수 있다고 주장했지만, 이는 회사와 파트너 측의 주장이다. GPU와 d-Matrix 하드웨어를 포괄적으로 비교한 독립 검증 결과로 해석해서는 안 된다. 22
d-Matrix의 첫 Raptor 랙은 엔비디아 MGX 레퍼런스 아키텍처를 따를 예정이다. 보도된 로드맵에는 최대 144개의 Raptor 가속기를 하나의 NVLink 패브릭으로 묶는 NVL144형 설계도 언급된다. 다만 이는 향후 계획이며, 출하 제품의 확정 사양은 아니다. 2
현재 공개된 가장 구체적인 일정은 Raptor XPU가 통합된 엔비디아 MGX 랙의 초기 제공 목표인 2027년 4분기다. 8
따라서 성능, 용량, 가격, 실제 배치 방식은 최종 시스템과 재현 가능한 독립 벤치마크가 나올 때까지 로드맵 목표로 보는 것이 적절하다.
엔비디아가 제3자 추론 가속기를 자사 플랫폼에 받아들이는 일은 얼핏 GPU 사업에 불리해 보일 수 있다. 그러나 전략은 반대다. 고객이 d-Matrix 같은 다른 연산 칩을 택하더라도, 고가치 계층인 인터커넥트·네트워킹·랙 아키텍처를 엔비디아 생태계 안에 남길 수 있기 때문이다.
NVLink Fusion은 NVLink 패브릭, Spectrum-X 네트워킹, MGX 랙 설계 등 핵심 인프라를 엔비디아 플랫폼에 묶어 둔다. d-Matrix와 고객에게는 통합 위험과 구축 시간을 줄이는 장점이 있고, 엔비디아에는 고객이 완전히 비(非)엔비디아 기반 클러스터를 별도로 구축할 유인을 낮추는 효과가 있다. 1
14
엔비디아가 말하는 ‘수직 통합적이고 수평적으로 개방된’ 플랫폼은 이런 맥락에서 이해할 수 있다.
이는 모든 가속기가 서로 바꿔 쓸 수 있거나 성능이 같다는 뜻은 아니다. 이 맥락에서 ‘대체 가능성’은 워크로드에 맞는 연산 자원을 고르되, 인프라 토대는 공통으로 유지하려는 운영상의 목표에 가깝다.
Raptor는 제안된 프리필·디코드 분업에서 엔비디아 GPU를 보완하는 위치에 있다. 동시에 엔비디아가 계획 중인 Groq 3 LPU 기반의 전용 디코드 시스템과는 같은 전문 추론 시장을 겨냥한다. 엔비디아는 Groq 3 LPX를 Vera Rubin NVL72 인프라와 결합할 수 있는 목적형 디코드 솔루션으로 제시해 왔다. 24
따라서 관계는 이중적이다. Raptor는 GPU와 함께 작동하고 엔비디아의 인프라를 사용한다는 점에서는 보완재지만, 전용 디코드 가속기라는 점에서는 엔비디아의 자체 제품과 경쟁할 가능성도 있다. 현재 공개된 정보만으로 지연시간, 처리량, 전력 효율, 가격, 공급 시점의 우열을 판단하기는 어렵다.
d-Matrix는 2025년 11월 시리즈 C에서 2억7,500만 달러를 조달했고, 당시 기업가치는 20억 달러였다. 회사가 밝힌 누적 조달액은 4억5,000만 달러다. 27
현행 추론 플랫폼은 Corsair이며, Raptor는 NVLink Fusion 로드맵에 포함된 차세대 XPU다. Corsair는 Parasail과의 협력에서 이미 엔비디아 인프라와 함께 사용될 계획이 발표됐다. Raptor의 차별점은 엔비디아의 랙 규모 환경으로 더 직접적으로 들어가는 경로가 마련됐다는 데 있다. 22
양사는 이번 협력의 재무 조건을 공개하지 않았다. 따라서 라이선스 로열티, 최소 구매 약정, 개발비, 매출 배분, 우대 조건의 존재 여부는 공개 기록만으로 확인할 수 없다.
이번 발표는 당장의 성능 승부라기보다 인프라 로드맵으로 보는 편이 맞다. d-Matrix는 특화된 디코드 하드웨어를 엔비디아 기반 AI 팩토리에 배치할 경로를 얻었고, 엔비디아는 자사 인터커넥트와 랙 생태계에 연결될 수 있는 연산 칩의 범위를 넓혔다. 실제 추론 비용과 성능의 우위는 최종 하드웨어, 소프트웨어 통합, 가격, 독립적으로 재현 가능한 워크로드 결과가 나와야 판단할 수 있다. 1
8
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
d Matrix는 Raptor 추론 XPU를 엔비디아 NVLink Fusion으로 연결해 MGX 기반 AI 인프라에 배치하는 다년 제품 로드맵을 발표했다.
d Matrix는 Raptor 추론 XPU를 엔비디아 NVLink Fusion으로 연결해 MGX 기반 AI 인프라에 배치하는 다년 제품 로드맵을 발표했다. 구성에는 Vera CPU, NVLink 스위치, BlueField 4 DPU, ConnectX 9 SuperNIC, Spectrum X 이더넷이 포함될 예정이다.
핵심은 단순한 칩 연결이 아니라 GPU·CPU·XPU가 공통 랙·네트워킹 기반을 공유하도록 하는 시스템 통합이다.