d Matrix намерена подключить XPU Raptor для ИИ инференса к платформе NVIDIA через NVLink Fusion и стоечную архитектуру MGX. План предполагает разделение инференса: GPU NVIDIA выполняют prefill, а Raptor берёт на себя поэтапную генерацию токенов.
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did AI chip startup d-Matrix announce about integrating Nvidia’s NVLink Fusion into its next-generation Raptor inference processors, ho. Article summary: d-Matrix announced a multiyear roadmap to integrate Nvidia’s NVLink Fusion into its next-generation Raptor inference XPUs, making its specialized decode hardware deployable as part of Nvidia-based AI factories rather tha. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
d-Matrix выбрала путь к масштабному ИИ-инференсу, при котором заказчику не придётся строить отдельный кластер под ускорители стартапа. Компания сообщила, что интегрирует технологию NVIDIA NVLink Fusion в XPU Raptor следующего поколения. Это должно связать чипы d-Matrix со стоечной архитектурой NVIDIA MGX и более широкой инфраструктурной платформой NVIDIA для ИИ. Компании называют эту работу многолетней продуктовой дорожной картой; первые Raptor XPU, интегрированные в стойки MGX, ожидаются в IV квартале 2027 года. 1
8
NVLink Fusion — технология и интеллектуальная собственность NVIDIA для высокоскоростного низколатентного соединения, позволяющая встраивать кастомные CPU и XPU в ИИ-инфраструктуру NVIDIA. Для d-Matrix это означает, что Raptor сможет работать с сетью масштабирования NVLink, сетью горизонтального масштабирования Spectrum-X и конструкциями стоек MGX, а не только в специально спроектированной системе. 1
14
Планируемая стойка включает процессоры NVIDIA Vera, коммутаторы NVLink, DPU BlueField-4, SuperNIC ConnectX-9 и Ethernet-сеть Spectrum-X. По оценке d-Matrix, это даёт ей проверенный путь через задачи интеграции стоек, сетей, питания, охлаждения и поставок — то, что поставщикам кастомных ускорителей иначе пришлось бы собирать самостоятельно. 1
8
Практический смысл анонса — не просто в подключении ещё одного чипа к серверу, а в системной интеграции. Оператор дата-центра сможет использовать единый инфраструктурный подход, ориентированный на NVIDIA, для GPU, CPU и XPU d-Matrix, не проектируя отдельные стойки под каждый тип процессоров. 1
Предлагаемая архитектура основана на разделённом инференсе. GPU NVIDIA отвечают за ресурсоёмкую стадию prefill, а специализированное оборудование d-Matrix предназначено для стадии decode — последовательной генерации токенов.
На этапе prefill система обрабатывает входной запрос, а на decode формирует продолжение ответа токен за токеном. Такое разделение должно позволить каждому типу процессоров выполнять ту часть задачи, для которой он предназначен. Ранее d-Matrix сообщала, что Parasail развернёт её нынешние ускорители Corsair вместе с системами NVIDIA Hopper и Blackwell, используя схожую схему prefill/decode. 22
Однако потенциальный выигрыш зависит от конкретной нагрузки. Заявление Parasail об ускорении сервисов до 10 раз и повышении их экономичности — это утверждение компаний для отдельных сценариев, а не независимое универсальное сравнение оборудования d-Matrix и GPU. 22
По данным d-Matrix, первая стойка Raptor будет построена по референсной архитектуре NVIDIA MGX. В публикациях о дорожной карте описывается конструкция класса NVL144, которая должна объединять до 144 ускорителей Raptor в единой фабрике NVLink; эти параметры относятся к будущим планам, а не к гарантированным характеристикам серийного продукта. 2
Более конкретный ориентир по доступности ограничен: первые XPU Raptor, интегрированные в стойку NVIDIA MGX, ожидаются в IV квартале 2027 года. 8
Поскольку Raptor пока не является поставляемым продуктом MGX, показатели производительности, ёмкости и детали внедрения следует считать целевыми параметрами дорожной карты до появления готовых систем и независимых тестов.
На первый взгляд допуск стороннего процессора для инференса может показаться шагом, ослабляющим позиции NVIDIA. Но стратегическая логика обратная: NVIDIA стремится сделать свою ИИ-платформу предпочтительной основой даже в тех случаях, когда вычислительный чип не является её GPU.
NVLink Fusion оставляет важные платформенные уровни — сеть масштабирования, сетевую инфраструктуру, архитектуру стоек и сопутствующие компоненты — внутри экосистемы NVIDIA. Для d-Matrix и её клиентов это может снизить риски интеграции и ускорить развёртывание. Для NVIDIA это уменьшает необходимость строить полностью отдельный кластер вне её экосистемы. 1
14
Именно так следует понимать формулу NVIDIA: «вертикально интегрированная и горизонтально открытая» платформа.
Это не означает, что все ускорители взаимозаменяемы или равны по производительности. В данном контексте «взаимозаменяемость» — скорее операционная цель: оператор может выбрать вычислительный ресурс под конкретную нагрузку, сохраняя общую инфраструктурную основу.
В предложенной схеме Raptor дополняет GPU NVIDIA, беря на себя decode, но одновременно работает в той же широкой нише специализированного инференса, что и планируемые системы NVIDIA на базе Groq 3 LPU. NVIDIA позиционировала Groq 3 LPX как специализированное решение для decode, которое может сочетаться с инфраструктурой Vera Rubin NVL72. 24
Отношения здесь двойственные. Raptor может дополнять GPU NVIDIA и использовать инфраструктуру её платформы, но потенциально также конкурировать с собственным специализированным решением NVIDIA для decode. Имеющейся информации недостаточно для содержательного прямого сравнения задержки, пропускной способности, энергопотребления, цены или доступности этих систем.
В ноябре 2025 года d-Matrix сообщила о привлечении $275 млн в раунде Series C при оценке компании в $2 млрд. Общий объём привлечённого финансирования достиг $450 млн. 27 Текущая платформа для инференса компании называется Corsair; Raptor — XPU следующего поколения, упомянутый в дорожной карте NVLink Fusion.
Corsair уже лежит в основе партнёрства d-Matrix с Parasail: компания сообщала о планах использовать эти ускорители вместе с инфраструктурой NVIDIA для отдельных нагрузок инференса. 22 Значение Raptor в том, что d-Matrix теперь планирует более прямой путь в стоечную среду NVIDIA.
Финансовые условия сделки не раскрыты. Поэтому публичные данные не позволяют установить, предусмотрены ли лицензионные отчисления, обязательства по минимальным закупкам, инженерные платежи, распределение выручки или какие-либо льготные коммерческие условия.
Таким образом, анонс стоит рассматривать как важную инфраструктурную дорожную карту: d-Matrix получает путь для размещения специализированного оборудования decode в ИИ-фабриках на базе NVIDIA, а NVIDIA расширяет круг вычислительных чипов, способных использовать её межсоединения и экосистему стоек. Превратится ли это в более выгодную экономику инференса в реальных условиях, будет зависеть от готового оборудования, интеграции ПО, ценообразования и независимо воспроизводимых результатов на реальных нагрузках. 1
8
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
d Matrix намерена подключить XPU Raptor для ИИ инференса к платформе NVIDIA через NVLink Fusion и стоечную архитектуру MGX.
d Matrix намерена подключить XPU Raptor для ИИ инференса к платформе NVIDIA через NVLink Fusion и стоечную архитектуру MGX. План предполагает разделение инференса: GPU NVIDIA выполняют prefill, а Raptor берёт на себя поэтапную генерацию токенов.
Для NVIDIA партнёрство расширяет выбор вычислительных чипов, но сохраняет сеть, межсоединения и архитектуру стоек внутри её экосистемы.