Microsoft जानबूझकर अपने अगली पीढ़ी के AI इंफ्रास्ट्रक्चर को AMD Helios और Nvidia Vera Rubin के बीच बांट रहा है। इसका मुख्य उद्देश्य सप्लाई चेन के जोखिम को कम करना और एक ही विक्रेता पर निर्भरता (लॉक-इन) से बचना है । यह कंपनी के Azure और Copilot के भीतर मॉडल-अज्ञेयवादी दृष्टिकोण को दर्शाता है । CEO सत्या नडेला ने पुष्टि की, "हम AMD Helios और Nvidia Vera Rubin पर आधारित अगली पीढ़ी के रैक-स्केल AI इंफ्रास्ट्रक्चर को तैनात करने वाले पहले क्लाउड प्रदाताओं में से एक होंगे।" इससे Microsoft को न केवल बेहतर मोलभाव करने की ताकत मिलती है, बल्कि अगर किसी एक विक्रेता को आवंटन की समस्या होती है, तो उसके पास दूसरा विकल्प भी होता है । उद्योग में इसे "अपने दांव को कवर करना" (hedging bets) कहा जा रहा है ।
न तो AMD और न ही Microsoft ने सटीक कीमतों का खुलासा किया है, लेकिन Futurum Group के विश्लेषक अनुमान एक स्पष्ट तस्वीर पेश करते हैं:
इसका मतलब है कि Helios, प्रति रैक के आधार पर Vera Rubin से लगभग 40% अधिक महंगा है । यह अतिरिक्त लागत Helios की अधिक मेमोरी क्षमता, ओपन आर्किटेक्चर और AMD के एकीकृत CPU-GPU-नेटवर्किंग पोर्टफोलियो के कारण है ।
AMD का तर्क है कि Helios की उच्च शुरुआती लागत बेहतर प्रदर्शन दक्षता से उचित है। AMD के अपने प्रयोगशाला डेटा के अनुसार, Helios :
AMD की CEO लिसा सु ने Advancing AI 2026 इवेंट में ये आंकड़े पेश करते हुए कहा कि Helios "सबसे बड़े मॉडलों पर प्रतिस्पर्धा से 15% या उससे अधिक प्रदर्शन, 50% अधिक HBM क्षमता और प्रति डॉलर 30% अधिक टोकन प्रदान करता है" ।
हालांकि, विश्लेषकों का कहना है कि ये प्री-प्रोडक्शन अनुमान हैं। Futurum Group ने नोट किया कि "AMD के 15% प्रदर्शन लाभ और 30% टोकन-प्रति-डॉलर के दावे एक अप्रेषित (बिना भेजे गए) प्रतिस्पर्धी के खिलाफ विक्रेता गणित पर आधारित हैं और दो तिमाहियों के भीतर प्रोडक्शन में परखे जाएंगे" ।
AMD Helios एक विशेष उद्देश्य के लिए बनाया गया, लिक्विड-कूल्ड रैक-स्केल सिस्टम है जो कंपनी की अब तक की सबसे व्यापक AI हार्डवेयर पेशकश है :
| कंपोनेंट | विनिर्देश |
|---|---|
| GPUs | 72x AMD Instinct MI455X |
| GPU आर्किटेक्चर | CDNA 5 (TSMC में 2nm/3nm चिपलेट हाइब्रिड) |
| प्रति GPU ट्रांजिस्टर | 320 बिलियन |
| CPU | 18x 6वीं पीढ़ी का AMD EPYC "Venice" (प्रति कंप्यूट ट्रे एक, अधिकतम 256 कोर प्रति CPU) |
| नेटवर्किंग | AMD Pensando "Vulcano" 800 AI NIC (800 Gbps ईथरनेट, प्रति GPU 2.4 Tbps तक स्केल-आउट) |
| स्केल-अप इंटरकनेक्ट | UALink (ईथरनेट पर टनल किया गया अल्ट्रा एक्सेलेरेटर लिंक) |
| स्केल-आउट इंटरकनेक्ट | अल्ट्रा ईथरनेट कंसोर्टियम (UEC) के अनुरूप |
| कुल HBM4 मेमोरी | 31 TB प्रति रैक |
| प्रति GPU मेमोरी | 432 GB (प्रत्येक 36 GB के 12 स्टैक HBM4) |
| प्रति GPU मेमोरी बैंडविड्थ | 19.6 TB/s |
| कुल मेमोरी बैंडविड्थ | 1.7 PB/s प्रति रैक |
| FP4 प्रदर्शन | 2.9 एक्साफ्लॉप्स प्रति रैक |
| FP8 प्रदर्शन | 1.4 एक्साफ्लॉप्स प्रति रैक |
| स्केल-अप बैंडविड्थ | 260 TB/s |
| स्केल-आउट बैंडविड्थ | 43 TB/s |
| फॉर्म फैक्टर | 18 लिक्विड-कूल्ड कंप्यूट ट्रे (प्रत्येक में 4 GPU) + 6 स्विच ट्रे, OCP ओपन रैक वाइड संगत |
| प्रति-GPU प्रदर्शन | 40 PFLOPS FP4, 20 PFLOPS FP8 |
प्रत्येक कंप्यूट ट्रे में चार MI455X GPU, एक EPYC Venice CPU और Pensando नेटवर्किंग शामिल है, जो सभी UALink प्रोटोकॉल के माध्यम से जुड़े हैं ताकि 72 GPU एकल कंप्यूट यूनिट के रूप में काम कर सकें ।
AMD ने निम्नलिखित प्रारंभिक Helios ग्राहकों को सुरक्षित किया है :
एक उल्लेखनीय अनुपस्थिति: जुलाई 2026 तक किसी भी बड़ी घोषणा में Anthropic को Helios के शुरुआती ग्राहक के रूप में सार्वजनिक रूप से नामित नहीं किया गया है ।
Microsoft का AMD Helios और Nvidia Vera Rubin दोनों को तैनात करने का निर्णय संकेत देता है कि AI हार्डवेयर बाजार एक नए चरण में प्रवेश कर चुका है। एकल-विक्रेता निर्भरता के बजाय, हाइपरस्केलर कंपनियां सप्लाई सुरक्षित करने, बेहतर मोलभाव करने और अलग-अलग प्रदर्शन विशेषताओं तक पहुंचने के लिए प्लेटफॉर्म विविधता में निवेश कर रही हैं ।
AMD Helios, अपनी विशाल 31 TB HBM4 मेमोरी और ओपन ईथरनेट-आधारित इंटरकनेक्ट के साथ, विशेष रूप से बड़े पैमाने पर इंफेरेंस वर्कलोड के लिए उपयुक्त है, जहां मेमोरी क्षमता और बैंडविड्थ सीधे थ्रूपुट और प्रति-टोकन लागत को प्रभावित करते हैं । 2026 की दूसरी छमाही में शिपमेंट की उम्मीद के साथ, असली परीक्षा तब होगी जब उत्पादन बेंचमार्क प्रकाशित होंगे और प्रतिस्पर्धी दावों को बड़े पैमाने पर सत्यापित किया जा सकेगा ।