Silicon Data का मिश्रित LLM टोकन मूल्य सूचकांक 1 सितंबर 2026 को रिकॉर्ड निचले स्तर 0.97 डॉलर प्रति 10 लाख टोकन पर पहुंचा, जो गर्मियों की शुरुआत के शिखर के आधे से भी कम है। DeepSeek V4 Flash की सूचीबद्ध कीमत 0.14 डॉलर प्रति 10 लाख इनपुट टोकन थी, जबकि चीन में मार्च 2026 तक रोजाना AI टोकन उपयोग 140 ट्रिलियन से अधिक बता...
प्रकाशितकर्ताGPT-5.6 Terra से संपादितGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: How has the Chinese AI-lab price war—marked by June 2026 international API cuts of 50–99% by DeepSeek, Alibaba Cloud, ByteDance, Moonshot AI. Article summary: China’s price war appears to have reset the marginal market price of LLM inference rather than reduced demand. Aggressive low-cost Chinese APIs pulled customers toward cheaper models and altered the usage mix, helping dr. Topic tags: general, general web, user generated, education, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
चीनी AI लैब्स की आक्रामक API कीमतों ने यह धारणा बदल दी है कि सामान्य LLM इन्फरेंस—यानी मॉडल से जवाब या आउटपुट लेने—की लागत कितनी होनी चाहिए। Silicon Data का LLM Token Expenditure Index 1 सितंबर 2026 को 0.97 डॉलर प्रति 10 लाख टोकन पर पहुंच गया। यह रिकॉर्ड निचला स्तर था और गर्मियों की शुरुआत के शिखर के आधे से भी कम था। लेकिन इसका मतलब यह नहीं कि AI की मांग या कुल खर्च घट गया है। यह सूचकांक प्रति 10 लाख टोकन दी जाने वाली प्रभावी, उपयोग-भारित कीमत मापता है; यह कुल इस्तेमाल हुए टोकन या AI पर खर्च हुए कुल डॉलर का आंकड़ा नहीं है। 2
4
Silicon Data के अनुसार, SDLLMTK मिश्रित LLM इन्फरेंस टोकन कीमतों का एक बेंचमार्क है। यह तय मॉडल-समूह में प्रदाताओं की कीमतों और देखे गए उपयोग को मिलाकर प्रति 10 लाख टोकन प्रभावी बाजार कीमत निकालता है। 2
4
यही अंतर अहम है। यदि उपयोगकर्ता अपने ज्यादा काम कम-लागत वाले मॉडलों की ओर भेजने लगें, तो सूचकांक नीचे जा सकता है—भले ही कुल टोकन उपयोग और संस्थाओं का AI खर्च दोनों बढ़ रहे हों। दूसरे शब्दों में, यह कीमत और वर्कलोड के बदलते मिश्रण को दर्शाता है, पूरी AI बाजार आय को नहीं।
प्राइस वॉर ने उन कामों के लिए बेहद सस्ते विकल्प दिए, जिनके लिए सबसे महंगे फ्रंटियर मॉडल की जरूरत नहीं होती। उदाहरण के लिए, DeepSeek V4-Flash की सूचीबद्ध कीमत 0.14 डॉलर प्रति 10 लाख इनपुट टोकन और 0.28 डॉलर प्रति 10 लाख आउटपुट टोकन थी। 49
DeepSeek ने मई 2026 में V4-Pro की कीमत भी 75% घटाई। रिपोर्टिंग में इसे चीनी मॉडल प्रदाताओं के बीच प्रतिस्पर्धा तेज होने के संकेत के रूप में देखा गया। 58 चीन के AI इकोसिस्टम में अन्य सस्ते मॉडल और कीमत कटौतियों ने बड़े पैमाने के इन्फरेंस वर्कलोड के लिए प्रतिस्पर्धा कर रहे प्रदाताओं पर दबाव बढ़ाया।
4
52
उपलब्ध साक्ष्य इस प्रतिस्पर्धी माहौल और मिश्रित टोकन कीमतों में गिरावट के बीच मजबूत संबंध दिखाते हैं। हालांकि, इससे किसी एक लैब, मॉडल या घोषित कटौती का सटीक कारणात्मक हिस्सा तय नहीं किया जा सकता। मॉडल की दक्षता, क्षमता विस्तार और ग्राहकों के अपने मॉडल-रूटिंग फैसले भी सूचकांक को प्रभावित करते हैं।
यह विरोधाभास एक सरल संबंध से समझा जा सकता है:
कुल टोकन खर्च = प्रति टोकन प्रभावी कीमत × टोकन की मात्रा
कम इकाई लागत अधिक उपयोग-मामलों को आर्थिक रूप से व्यवहार्य बनाती है। कंपनियां ज्यादा स्वचालित वर्कफ़्लो चला सकती हैं, लंबे प्रॉम्प्ट और कॉन्टेक्स्ट इस्तेमाल कर सकती हैं, अधिक कोड जनरेट कर सकती हैं या ज्यादा AI एजेंट संचालित कर सकती हैं। यदि टोकन उपयोग की मात्रा, प्रभावी कीमत की गिरावट से तेज बढ़े, तो कुल खर्च बढ़ेगा।
यह रुझान उन रिपोर्टों से मेल खाता है जिनमें 2023 से प्रति टोकन कीमत में 90% से अधिक गिरावट, लेकिन 2025 के अंत से LLM उपयोग पर खर्च करीब दोगुना होने की बात कही गई है। 41
43 इसका मूल कारण कीमत कटौती की विफलता नहीं, बल्कि उपयोग का विस्तार है: सस्ता इन्फरेंस उन कामों की संख्या बढ़ा देता है जिन्हें स्वचालित करना फायदेमंद लगता है।
Reuters द्वारा उद्धृत सरकारी अनुमानों के अनुसार, मार्च 2026 तक चीन में प्रतिदिन AI टोकन उपयोग 140 ट्रिलियन से अधिक हो गया था, जो 2025 के अंत के 100 ट्रिलियन से बढ़ा था। 18
उद्यमों और वित्तीय क्षेत्र के खुलासे भी इसी दिशा की ओर इशारा करते हैं। China Merchants Bank ने कहा कि उसका औसत दैनिक टोकन थ्रूपुट साल-दर-साल 78% से अधिक बढ़ा। अलग रिपोर्टिंग के अनुसार, मई के अंत तक बैंक का दैनिक उपयोग करीब 33 अरब टोकन था। 19
29 रिपोर्टों में यह भी कहा गया कि कुछ चीनी बैंकों में औसत दैनिक टोकन उपयोग इससे कहीं अधिक तेजी से बढ़ा।
20
इन आंकड़ों को API राजस्व का प्रत्यक्ष पैमाना या हर AI वर्कलोड के आर्थिक रूप से उपयोगी होने का प्रमाण नहीं मानना चाहिए। फिर भी, वे दिखाते हैं कि कम-लागत इन्फरेंस बड़े पैमाने पर कहीं अधिक उपयोग में बदल रहा है।
AI खरीदने वाली कंपनियों के लिए इन्फरेंस कीमतों में गिरावट फायदेमंद है। लेकिन मॉडल विक्रेताओं के लिए इससे कारोबारी गणित कठिन हो जाता है: प्रति टोकन राजस्व घट सकता है, जबकि चिप, डेटा सेंटर, प्रशिक्षण और मॉडल विकास पर खर्च ऊंचा बना रहता है।
अब मुख्य सवाल यह नहीं है कि ग्राहक सस्ते टोकन इस्तेमाल करेंगे या नहीं। उपलब्ध संकेत बताते हैं कि वे करेंगे। सवाल यह है कि क्या ज्यादा उपयोग, प्रीमियम पेशकशें और एंटरप्राइज उत्पाद इतना टिकाऊ राजस्व तथा मापने योग्य उत्पादकता लाभ पैदा कर पाएंगे कि बुनियादी ढांचे में लगातार निवेश को सहारा मिल सके। सूचकांक में गिरावट पर रिपोर्टिंग ने प्रदाताओं की मूल्य निर्धारण क्षमता के इसी जोखिम को रेखांकित किया है। 4
36
किसी एक मॉडल की सूचीबद्ध कीमत से ज्यादा उपयोगी ये संकेतक होंगे:
मुख्य निष्कर्ष साफ है: चीन की कम-लागत API प्रतिस्पर्धा ने LLM इन्फरेंस को काफी सस्ता बनाया है और मिश्रित बाजार कीमत को 10 लाख टोकन पर 1 डॉलर से नीचे धकेलने में मदद की है। लेकिन कम कीमतें अधिक उपयोग को प्रोत्साहित कर रही हैं। इसलिए टोकन खपत और कुल AI खर्च, दोनों एक साथ बढ़ते रह सकते हैं। 2
4
41
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
Silicon Data का मिश्रित LLM टोकन मूल्य सूचकांक 1 सितंबर 2026 को रिकॉर्ड निचले स्तर 0.97 डॉलर प्रति 10 लाख टोकन पर पहुंचा, जो गर्मियों की शुरुआत के शिखर के आधे से भी कम है।
Silicon Data का मिश्रित LLM टोकन मूल्य सूचकांक 1 सितंबर 2026 को रिकॉर्ड निचले स्तर 0.97 डॉलर प्रति 10 लाख टोकन पर पहुंचा, जो गर्मियों की शुरुआत के शिखर के आधे से भी कम है। DeepSeek V4 Flash की सूचीबद्ध कीमत 0.14 डॉलर प्रति 10 लाख इनपुट टोकन थी, जबकि चीन में मार्च 2026 तक रोजाना AI टोकन उपयोग 140 ट्रिलियन से अधिक बताया गया।
टोकन सस्ते होने से कंपनियां अधिक वर्कफ़्लो, AI एजेंट और कोड जनरेशन कार्य चला सकती हैं; इसलिए प्रति टोकन लागत गिरने के बावजूद कुल AI खर्च बढ़ सकता है।