d Matrix, NVIDIA NVLink Fusion के जरिये अपने Raptor इंफेरेंस XPU को NVIDIA के रैक स्तरीय AI फैक्टरी डिज़ाइन में जोड़ने की योजना बना रही है। Raptor को लिक्विड कूल्ड NVL144/MGX संदर्भ आर्किटेक्चर में लगाया जा सकेगा; NVLink रैक के भीतर स्केल अप कनेक्टिविटी और Spectrum X रैक के बाहर स्केल आउट नेटवर्किंग देगा। [3][5] ऐसे...
प्रकाशितकर्ताGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: How does d Matrix’s adoption of Nvidia’s NVLink Fusion for its next generation Raptor inference processors enable the startup to plug its me. Article summary: d Matrix is using NVLink Fusion to make Raptor a native, rack scale participant in Nvidia’s AI factory design rather than a separate PCIe inference card.. Topic tags: general web, llm, ai, code, benchmarks. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layou
d-Matrix अपने अगली पीढ़ी के Raptor XPU को सिर्फ एक अलग PCIe इंफेरेंस कार्ड के रूप में नहीं बेचने की तैयारी कर रही है। NVIDIA NVLink Fusion अपनाने से Raptor को NVIDIA की रैक-स्तरीय AI फैक्टरी संरचना का मूल हिस्सा बनने का रास्ता मिलता है। यानी ग्राहक d-Matrix की मेमरी-केंद्रित इंफेरेंस क्षमता के साथ NVIDIA की इंटरकनेक्ट, नेटवर्किंग, I/O, प्रबंधन हार्डवेयर और तैयार रैक डिज़ाइन का उपयोग कर सकेंगे। 3
5
Raptor, NVLink Fusion इंटरफेस लागू करेगा और NVIDIA की लिक्विड-कूल्ड NVL144/MGX संदर्भ आर्किटेक्चर में फिट होगा। यहां दो स्तरों पर कनेक्टिविटी काम करती है:
यह व्यवस्था d-Matrix को अपना विशेष XPU देने देती है, जबकि पूरी मशीन के बाकी अहम ढांचे के लिए NVIDIA का स्थापित प्लेटफॉर्म इस्तेमाल होता है।
Raptor-आधारित MGX रैक में NVIDIA के Vera CPU, NVLink स्विच, BlueField-4 DPU, ConnectX-9 SuperNIC और Spectrum-X Ethernet नेटवर्किंग का उपयोग किया जा सकता है। दूसरे शब्दों में, d-Matrix का योगदान XPU होगा, लेकिन कंप्यूट सिस्टम का बड़ा हिस्सा—कंट्रोल-प्लेन, I/O, नेटवर्किंग, प्रबंधन और संदर्भ रैक डिज़ाइन—NVIDIA के प्लेटफॉर्म से आएगा। 5
d-Matrix का फोकस खास तौर पर जनरेटिव AI इंफेरेंस के डिकोड चरण पर है, जिसमें मॉडल एक-एक कर अगला टोकन बनाता है। इस चरण में मॉडल वेट को बार-बार मेमरी से पढ़ना पड़ता है; इसलिए मेमरी क्षमता और बैंडविड्थ निर्णायक हो सकती है।
GPU मॉडल के प्रीफिल चरण और सामान्य कंप्यूट के लिए उपयोगी बने रह सकते हैं, जबकि Raptor का लक्ष्य कम टोकन-विलंबता वाला डिकोड कार्य है। इसलिए यह रणनीति GPU को पूरी तरह बदलने के बजाय GPU–XPU का पूरक इंफेरेंस पाइपलाइन बनाने की है। 3
10
d-Matrix ने 144 Raptor XPU वाले रैक का लक्ष्य बताया है, जिसमें कुल 2.3 TB 3D-स्टैक्ड DRAM और लगभग 7.2 PB/s की पीक कुल मेमरी बैंडविड्थ होगी। कंपनी के अनुसार, 4-बिट प्रिसिजन पर यह क्षमता चार ट्रिलियन से अधिक पैरामीटर वाले मॉडल को मेमरी में रखने के लिए पर्याप्त हो सकती है। वास्तविक उपयोग योग्य मॉडल आकार हालांकि मेटाडेटा, रनटाइम स्टेट, मॉडल फॉर्मेट और सिस्टम सॉफ्टवेयर जैसे ओवरहेड पर निर्भर करेगा। 3
Raptor को 4-नैनोमीटर कंप्यूट डाई और कस्टम DRAM के संयोजन के रूप में बताया गया है। d-Matrix को 2026 के अंत तक टेप-आउट और 2027 की चौथी तिमाही में शुरुआती रैक-इंटीग्रेटेड सिस्टम उपलब्ध होने की उम्मीद है। 10
4
व्यावसायिक शर्तों का खुलासा नहीं किया गया है। 1 लेकिन आर्किटेक्चर को देखते हुए यह NVIDIA के लिए रणनीतिक रूप से महत्वपूर्ण है: यदि ग्राहक किसी विशेष तृतीय-पक्ष इंफेरेंस एक्सेलेरेटर को चुनते हैं, तब भी वे NVIDIA के रैक डिज़ाइन, फैब्रिक, स्विच, CPU, DPU, SuperNIC, Ethernet और संबद्ध इंफ्रास्ट्रक्चर के भीतर रह सकते हैं। यह साझेदारी की घोषित आर्थिक व्यवस्था नहीं, बल्कि प्लेटफॉर्म संरचना से निकला निष्कर्ष है।
3
5
d-Matrix अब NVLink Fusion इकोसिस्टम का हिस्सा है, जिसमें सार्वजनिक रूप से AWS, Arm, Intel, Fujitsu, MediaTek और Marvell जैसे साझेदारों के नाम भी जुड़े हैं। व्यापक लक्ष्य NVLink को अलग-अलग प्रकार के AI हार्डवेयर के लिए एक प्लेटफॉर्म इंटरफेस बनाना है। 3
d-Matrix ने नवंबर 2024 में अपना Corsair इंफेरेंस एक्सेलेरेटर लॉन्च किया था। बाद की फंडिंग में Microsoft के M12 की भागीदारी रही है। रिपोर्टों के अनुसार, 275 मिलियन डॉलर की Series C फंडिंग ने कंपनी का मूल्यांकन 2 अरब डॉलर किया, जबकि कुल जुटाई गई पूंजी करीब 450 मिलियन डॉलर बताई गई है। इन दोनों आंकड़ों को एक ही 450 मिलियन डॉलर के फंडिंग राउंड के रूप में नहीं पढ़ना चाहिए। 2
6
ParaSail ने Corsair और NVIDIA GPU को साथ इस्तेमाल करने पर इंफेरेंस गति में दस गुना तक सुधार की बात कही है, लेकिन यह कंपनी/ग्राहक का प्रदर्शन दावा है, स्वतंत्र बेंचमार्क नहीं। 12
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
d Matrix, NVIDIA NVLink Fusion के जरिये अपने Raptor इंफेरेंस XPU को NVIDIA के रैक स्तरीय AI फैक्टरी डिज़ाइन में जोड़ने की योजना बना रही है।
d Matrix, NVIDIA NVLink Fusion के जरिये अपने Raptor इंफेरेंस XPU को NVIDIA के रैक स्तरीय AI फैक्टरी डिज़ाइन में जोड़ने की योजना बना रही है। Raptor को लिक्विड कूल्ड NVL144/MGX संदर्भ आर्किटेक्चर में लगाया जा सकेगा; NVLink रैक के भीतर स्केल अप कनेक्टिविटी और Spectrum X रैक के बाहर स्केल आउट नेटवर्किंग देगा। [3][5]
ऐसे रैक में NVIDIA के Vera CPU, NVLink स्विच, BlueField 4 DPU, ConnectX 9 SuperNIC और Spectrum X Ethernet शामिल हो सकते हैं। [5]