Raptor будет подключаться к стоечной архитектуре NVIDIA MGX/NVL144 через NVLink Fusion, а не работать как отдельная PCIe карта. NVLink отвечает за высокоскоростное масштабирование внутри стойки, Spectrum X — за сетевое масштабирование за её пределы.
ОпубликовалИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: How does d Matrix’s adoption of Nvidia’s NVLink Fusion for its next generation Raptor inference processors enable the startup to plug its me. Article summary: d Matrix is using NVLink Fusion to make Raptor a native, rack scale participant in Nvidia’s AI factory design rather than a separate PCIe inference card.. Topic tags: general web, llm, ai, code, benchmarks. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layou
d-Matrix намерена использовать NVLink Fusion, чтобы Raptor стал штатным участником стоечной архитектуры NVIDIA для «ИИ-фабрик», а не отдельным ускорителем инференса на PCIe. Для заказчика это означает возможность применять ориентированный на память XPU для задач с жёсткими требованиями к задержке, сохраняя при этом инфраструктуру NVIDIA: внутреннюю фабрику соединений, сеть, управляющие компоненты и готовую конструкцию стойки. 3
5
Raptor должен реализовать интерфейс NVLink Fusion и интегрироваться в жидкостно охлаждаемую эталонную архитектуру NVIDIA NVL144/MGX. NVLink обеспечивает высокую пропускную способность и низкую задержку для объединения устройств внутри системы (scale-up), а Spectrum-X отвечает за соединение систем и стоек между собой (scale-out). 3
5
Иными словами, d-Matrix поставляет специализированный XPU, но значительная часть «обвязки» вычислительного комплекса остаётся на стороне NVIDIA.
В стойке на базе Raptor могут применяться:
Таким образом, NVIDIA предоставляет вычислительную платформу, ввод-вывод, сеть, средства управления и референсный дизайн стойки, а d-Matrix добавляет XPU для инференса. 5
GPU по-прежнему подходят для префилла модели — первоначальной обработки запроса — и универсальных вычислений. d-Matrix, напротив, нацеливает Raptor на этап декодирования, когда модель генерирует ответ токен за токеном и многократно обращается к своим весам. На этой стадии особенно важны объём и пропускная способность памяти.
Предполагаемая схема — не полная замена GPU, а совместный конвейер GPU–XPU: GPU выполняет одни части нагрузки, а Raptor ускоряет чувствительную к задержке генерацию токенов. 3
10
d-Matrix заявляет для стойки до 144 Raptor XPU, 2,3 ТБ 3D-стековой DRAM и суммарную пропускную способность памяти 7,2 ПБ/с. При делении этих стоечных показателей на 144 получается примерно 16 ГБ памяти и 50 ТБ/с на XPU. В принципе 2,3 ТБ достаточно для хранения модели более чем с четырьмя триллионами параметров при 4-битном представлении, однако реальный доступный размер модели будет меньше и зависит от метаданных, состояния выполнения и накладных расходов программного стека. 3
При этом в отдельных публикациях о Raptor приводятся другие характеристики одного ускорителя — 32 ГБ и 100 ТБ/с. Поэтому параметры уровня отдельного XPU и агрегированные показатели стойки следует воспринимать как предварительные до появления окончательных спецификаций продукта. 3
12
Raptor описывается как решение с 4-нм вычислительным кристаллом и специализированной DRAM. d-Matrix рассчитывает завершить tape-out к концу 2026 года, а первые интегрированные в стойку системы ожидаются в IV квартале 2027 года. 10
4
Для NVIDIA NVLink Fusion позволяет удерживать специализированные сторонние ускорители внутри собственной платформы, вместо того чтобы отдавать всю систему альтернативной экосистеме. Даже если основной чип инференса произведён не NVIDIA, компания может поставлять фабрику NVLink, коммутаторы, CPU, DPU, SuperNIC, Ethernet-инфраструктуру и элементы программно-инфраструктурного слоя.
Это вывод из архитектуры и модели поставки, а не раскрытая сторонами информация об экономике сделки. 3
5
d-Matrix вошла в число участников инициативы NVLink Fusion. Среди публично связанных с ней партнёров также упоминались AWS, Arm, Intel, Fujitsu, MediaTek и Marvell. Цель стратегии — превратить NVLink в платформенный интерфейс для разнородного оборудования ИИ-фабрик и расширить роль NVIDIA с поставщика ускорителей до поставщика всей окружающей системной фабрики. 3
В ноябре 2024 года d-Matrix представила ускоритель инференса Corsair. В более позднем финансировании участвовал венчурный фонд Microsoft M12: раунд Series C на 275 млн долларов оценил компанию в 2 млрд долларов, а совокупный объём привлечённого финансирования в отдельных сообщениях указывался примерно в 450 млн долларов. Эти цифры не следует считать одним раундом на 450 млн долларов. 2
6
ParaSail сообщала об ускорении инференса до десяти раз при совместном использовании Corsair и GPU NVIDIA, но это заявление компании или клиента, а не независимый бенчмарк. 12
Финансовые условия сотрудничества d-Matrix и NVIDIA не раскрывались. 1
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Raptor будет подключаться к стоечной архитектуре NVIDIA MGX/NVL144 через NVLink Fusion, а не работать как отдельная PCIe карта.
Raptor будет подключаться к стоечной архитектуре NVIDIA MGX/NVL144 через NVLink Fusion, а не работать как отдельная PCIe карта. NVLink отвечает за высокоскоростное масштабирование внутри стойки, Spectrum X — за сетевое масштабирование за её пределы.
В конфигурации могут использоваться CPU NVIDIA Vera, коммутаторы NVLink, DPU BlueField 4, SuperNIC ConnectX 9 и Ethernet Spectrum X.