इस नाटकीय उन्नयन के पीछे की थीसिस सरल है: AI क्रांति ट्रेनिंग से इंफ्रेंस की ओर बढ़ रही है, और भविष्य के वर्कलोड - स्वायत्त, बहु-चरणीय एजेंटिक AI सिस्टम - के लिए उद्योग की पिछली अपेक्षा से कहीं अधिक CPU पावर की आवश्यकता है ।
एजेंटिक AI वर्कलोड 2030 तक $220 बिलियन के सर्वर CPU बाजार का लगभग दो-तिहाई हिस्सा होने का अनुमान है । ये सिस्टम जटिल कार्यों को स्वायत्त रूप से संचालित करते हैं, GPU-आधारित मॉडल निष्पादन के साथ डेटा हैंडलिंग और समन्वय के लिए CPU पर बहुत अधिक निर्भर करते हैं ।
इंफ्रेंस AI कंप्यूट का प्रमुख उपयोग मामला बन गया है। 2026 में, पहली बार, इंफ्रेंस वर्कलोड वैश्विक AI कंप्यूट क्षमता का लगभग 60% उपभोग करेंगे, जो ट्रेनिंग से आगे निकल जाएगा । यह बदलाव CPU-भारी आर्किटेक्चर के पक्ष में है क्योंकि बड़े पैमाने पर मॉडलों की सेवा के लिए बड़ी संख्या में होस्ट CPU, इंफ्रेंस सर्वर और आसपास के बुनियादी ढांचे की आवश्यकता होती है ।
AMD यह भी देखता है कि व्यापक हाई-परफॉरमेंस और एडेप्टिव कंप्यूटिंग बाजार 2025 में $365 बिलियन से बढ़कर 2030 तक $2 ट्रिलियन तक पहुंच जाएगा । अकेले डेटा सेंटर सिलिकॉन बाजार के $1 ट्रिलियन से अधिक होने की उम्मीद है ।
23 जुलाई 2026 को Advancing AI 2026 में घोषित, Helios AMD का पहला पूरी तरह से एकीकृत, लिक्विड-कूल्ड रैक-स्केल AI सिस्टम है, जो 72 Instinct MI455X GPU, EPYC Venice CPU और Pensando नेटवर्किंग को जोड़ता है । यह जुलाई 2026 तक पूर्ण उत्पादन में है, Q3 2026 (सितंबर 2026) के अंत तक पार्टनर शिपमेंट शुरू हो जाएंगे और Q4 में वॉल्यूम रैंप होगा ।
यह रैक 2.9 एक्साफ्लॉप्स FP4 इंफ्रेंस थ्रूपुट और 1.4 एक्साफ्लॉप्स FP8 ट्रेनिंग थ्रूपुट देता है, जिसमें 260 TB/s की स्केल-अप इंटरकनेक्ट बैंडविड्थ है । पूरी तरह से लोडेड Helios रैक की कीमत लगभग $5.25 मिलियन होने का अनुमान है ।
TSMC के N2 (2nm) प्रोसेस पर बना, Venice CPU में प्रति सॉकेट 256 कोर तक हैं, जो 8 चिपलेट डाइज़ में से प्रत्येक पर 32 Zen 6c कोर पैक करता है । मई 2026 में TSMC ताइवान में प्रोडक्शन रैंप शुरू हुआ, भविष्य में TSMC की एरिजोना सुविधा में उत्पादन की योजना है (हालांकि 2028 से पहले वहां वॉल्यूम की उम्मीद नहीं है) ।
Venice वर्तमान में ग्राहकों को सैंपल किया जा रहा है और 2026 के अंत और 2027 की शुरुआत में Helios रैक के साथ-साथ स्टैंडअलोन सर्वर डिप्लॉयमेंट में भी शिप होगा । EPYC 9006 SP7 वेरिएंट, जो हाई-डेंसिटी एजेंट सैंडबॉक्स निष्पादन के लिए बनाया गया है, 2026 की चौथी तिमाही में शिप होने वाला है ।
AMD ने तीन प्रमुख AI कंपनियों से कुल मिलाकर लगभग 14 गीगावॉट कंप्यूट क्षमता की महत्वपूर्ण प्रतिबद्धताएं हासिल की हैं :
| ग्राहक | प्रतिबद्धता | विवरण |
|---|---|---|
| OpenAI | ~6 GW | अक्टूबर 2025 में घोषित सौदा। AMD की लगभग 10% इक्विटी परफॉरमेंस वारंट के रूप में जारी की गई। OpenAI को Q4 2026 से Helios ऑनलाइन लाने की उम्मीद है । |
| Meta | ~6 GW | फरवरी 2026 में घोषित सौदा। इसमें कस्टम MI450-सीरीज चिप्स और Open Compute Project के माध्यम से सह-विकसित Helios रैक आर्किटेक्चर शामिल है। Meta अभी भी EPYC प्लेटफॉर्म को मान्य कर रहा है और Helios सिस्टम का परीक्षण कर रहा है । |
| Anthropic | 2 GW तक | जुलाई 2026 में घोषित सौदा। AMD ने $5 बिलियन तक का सामरिक इक्विटी निवेश किया है। MI450-सीरीज GPU क्षमता का पहला गीगावॉट H1 2027 में शिप होने की उम्मीद है । |
अतिरिक्त ग्राहकों में Microsoft (Azure डेटा सेंटर के अंदर Helios रैक तैनात कर रहा है) और Oracle (50,000-GPU Helios सुपरक्लस्टर बना रहा है) शामिल हैं ।
AMD का ROCm सॉफ्टवेयर स्टैक काफी आगे बढ़ा है, लेकिन फिर भी Nvidia के CUDA से कुछ मामलों में पीछे है:
क्या काम करता है:
शेष अंतराल:
निचली पंक्ति: ROCm अब इंफ्रेंस के लिए उत्पादन-योग्य है और प्रति-टोकन मूल्य पर प्रतिस्पर्धी है (समतुल्य हार्डवेयर पर इंफ्रेंस वर्कलोड के लिए Nvidia की तुलना में 25–40% सस्ता होने की रिपोर्ट है), लेकिन CUDA टूलिंग, ट्रेनिंग वर्कफ़्लो और फ्रेमवर्क सपोर्ट की व्यापकता में एक सार्थक बढ़त बनाए हुए है ।
AMD के Q2 2026 के परिणाम कंपनी की सामरिक दिशा का दृढ़ता से समर्थन करते हैं:
| मीट्रिक | Q2 2026 | साल-दर-साल परिवर्तन |
|---|---|---|
| कुल राजस्व | $11.5 बिलियन | रिकॉर्ड उच्च |
| डेटा सेंटर राजस्व | $6.7 बिलियन | दोगुने से अधिक |
| कुल राजस्व का % में डेटा सेंटर | ~58% | एक साल पहले 42% से ऊपर |
| सर्वर CPU राजस्व वृद्धि | >70% | इंफ्रेंस/एजेंटिक AI द्वारा संचालित |
प्रबंधन ने कमाई कॉल पर उल्लेख किया कि "इंफेरेंसिंग और एजेंटिक AI सर्वर CPU कंप्यूट की आवश्यकता बढ़ा रहे हैं" जो उठाए गए TAM के पीछे संरचनात्मक चालक है । AMD को उम्मीद है कि 2027 तक डेटा सेंटर AI राजस्व "दसियों अरब डॉलर" तक पहुंच जाएगा, जिसमें अकेले सर्वर CPU राजस्व 2027 में 70% से अधिक बढ़ने का अनुमान है ।
सकल मार्जिन प्रक्षेपवक्र: जैसे-जैसे AMD अलग-अलग चिप्स बेचने से एकीकृत रैक-स्केल सिस्टम (जैसे Helios) की ओर बढ़ता है - जो एक पैकेज में GPU, CPU और नेटवर्किंग को बंडल करता है - शुद्ध चिप बिक्री की तुलना में मिश्रित मार्जिन पर दबाव पड़ सकता है। बाजार देख रहा है कि क्या AMD मार्जिन विस्तार को बनाए रख सकता है क्योंकि यह Nvidia की तरह एक सिस्टम प्रदाता बन जाता है।
TSMC आपूर्ति श्रृंखला एकाग्रता: AMD अत्याधुनिक CPU (N2) और GPU (N3/N4) उत्पादन दोनों के लिए TSMC पर निर्भर है । Venice TSMC ताइवान में रैंप कर रहा है, और जबकि AMD ने TSMC की एरिजोना सुविधा में भविष्य के उत्पादन की योजना बनाई है, वह क्षमता अत्याधुनिक नोड्स के लिए अभी तक ऑनलाइन नहीं है । ताइवान के आसपास भू-राजनीतिक तनाव और Apple, Nvidia और अन्य से TSMC वेफर आवंटन के लिए प्रतिस्पर्धा महत्वपूर्ण अल्पकालिक जोखिम बने हुए हैं, खासकर जब AMD 2026 के अंत से गीगावॉट पैमाने पर Helios शिप करने की योजना बना रहा है।
AMD एक स्पष्ट, महत्वाकांक्षी रणनीति पर अमल कर रहा है जो AI वर्कलोड में एक महत्वपूर्ण मोड़ पर टिकी है - ट्रेनिंग से इंफ्रेंस तक, पृथक मॉडल से स्वायत्त एजेंटों तक। कंपनी का हार्डवेयर रोडमैप (Helios और Venice) उत्पादन में है, इसके सबसे बड़े ग्राहक अभूतपूर्व पैमाने पर प्रतिबद्ध हैं, और इसके वित्तीय परिणाम बदलाव को दर्शा रहे हैं। मुख्य खुले प्रश्न यह हैं कि क्या ROCm CUDA के साथ शेष अंतर को जल्दी से बंद कर सकता है और क्या आपूर्ति श्रृंखला की बाधाएं AMD को अपने आक्रामक रैंप शेड्यूल को पूरा करने की अनुमति देंगी।