एंटरप्राइज AI इन्फ्रेंस लागत अगस्त 2026 की शुरुआत में $1.16–$1.18 प्रति मिलियन टोकन के साथ साल के सबसे निचले स्तर पर पहुंच गई, जो 31 मई को $2.04 से 43% कम है। OpenAI ने 30 जुलाई को GPT 5.6 Luna और Terra की कीमतों में क्रमशः 80% और 20% की कटौती की, जबकि DeepSeek ने 31 जुलाई को V4 Flash 0731 को $0.14/$0.28 प्रति मिलिय...
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: What caused enterprise AI inference costs to hit their lowest level in 2026 in early August, and what specific price data, trends, and compe. Article summary: Enterprise AI inference costs hit a 2026 low in early August, averaging **$1.16–$1.18 per million tokens** — a ~43% drop from $2.04 on May 31 — driven by an intensifying global price war, OpenAI's steep cuts, and the sur. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
एंटरप्राइज AI इन्फ्रेंस की लागत अगस्त 2026 की शुरुआत में साल के सबसे निचले स्तर पर पहुंच गई, जो $1.16–$1.18 प्रति मिलियन टोकन के औसत पर है। यह 31 मई को दर्ज $2.04 से लगभग 43% की गिरावट है। इसका मुख्य कारण एक तीव्र वैश्विक मूल्य युद्ध, OpenAI द्वारा भारी कटौती और सस्ते चीनी ओपन-सोर्स मॉडल्स का उभार है, जैसा कि Jefferies रिसर्च और Silicon Data के इंडेक्स से पता चलता है ।
Jefferies रिसर्च — निवेश बैंक Jefferies ने 10 अगस्त, 2026 को एक रिपोर्ट प्रकाशित की, जिसमें बताया गया कि एंटरप्राइज AI इन्फ्रेंस की कीमतें साल के सबसे निचले स्तर पर आ गई हैं। SCMP के अनुसार, उनके डेटा से पता चला कि 6-8 अगस्त, 2026 के दौरान औसत इन्फ्रेंस कीमतें $1.16–$1.18 प्रति मिलियन टोकन थीं । यह 31 मई को दर्ज $2.04 से लगभग 43% की गिरावट है
।
Silicon Data का LLM टोकन व्यय सूचकांक — इस सूचकांक ने जून की शुरुआत में $2 प्रति मिलियन टोकन से अगस्त के पहले सप्ताह में $1.20 तक गिरावट दर्ज की — दो महीनों में लगभग 40% की गिरावट । 27 जुलाई को एक स्नैपशॉट में $1.43 दिखाया गया, जो नीचे की ओर रुझान की पुष्टि करता है
। Silicon Data ने सीधे तौर पर चीनी ओपन-वेट मॉडल्स को इंडेक्स औसत को नीचे खींचने वाले प्राथमिक कारक के रूप में उद्धृत किया
।
OpenAI ने API कीमतों में 80% तक की कटौती की, जिसका श्रेय बुनियादी ढांचे की दक्षता में सुधार को दिया। CNBC और Forbes ने इसे AI मूल्य युद्ध को बढ़ाने वाला कदम बताया ।
OpenAI ने इन कटौतियों का श्रेय आंतरिक ऑप्टिमाइज़ेशन को दिया, जिसमें कर्नेल रिवाइट्स और स्पेक्युलेटिव डिकोडिंग शामिल हैं, जिससे इन्फ्रेंस वर्कलोड में 20-35% दक्षता लाभ हुआ ।
31 जुलाई, 2026 को, DeepSeek ने V4-Flash-0731 को पब्लिक बीटा में जारी किया, जिसकी कीमतें इस प्रकार रखीं:
प्रीमियम टियर मॉडल्स की लागत का लगभग दसवां हिस्सा होने के नाते, DeepSeek V4 Flash ने फर्श-सेटिंग मूल्य बनाया जिसने व्यापक बाजार संपीड़न को मजबूर किया। बेंचमार्क फर्म Artificial Analysis के अनुसार, V4 Flash की अनुमानित प्रति कार्य लागत लगभग 3 सेंट है । यह मॉडल DeepSeek द्वारा प्रकाशित हर एजेंटिक बेंचमार्क पर अपने स्वयं के V4 Pro प्रीव्यू को आउटपुट मूल्य के एक तिहाई पर हराता है
।
Opus 5 ने $5 प्रति मिलियन इनपुट टोकन और $25 प्रति मिलियन आउटपुट टोकन पर प्रवेश किया — जो अपने पूर्ववर्ती Opus 4.8 के समान है — जिसमें बेस मूल्य से 2x ($10/$50) पर फास्ट मोड है । जबकि Opus 5 ने स्वयं कीमतें नहीं काटीं, एक प्रतिस्पर्धी "नियर-फ्रंटियर" टियर पर इसके लॉन्च ने प्रतिद्वंद्वियों पर दबाव डाला और उद्यमों के लिए कम लागत वाले विकल्पों के सेट का विस्तार किया
।
OpenAI की 80% कटौती (30 जुलाई), DeepSeek की सब-$0.30 फ्लैश प्राइसिंग (31 जुलाई), Anthropic का प्रतिस्पर्धी Opus 5 लॉन्च (24 जुलाई), और कम लागत वाले चीनी ओपन-सोर्स मॉडल्स को व्यापक रूप से अपनाने से बाजार सूचकांक मई के अंत में $2.04 से अगस्त की शुरुआत में $1.16–$1.18 पर आ गया — दस सप्ताह में 43% की गिरावट ।
थॉमस चोंग के नेतृत्व में Jefferies के विश्लेषकों ने इस गिरावट का श्रेण "तीव्र वैश्विक मूल्य युद्ध" और "सस्ती चीनी ओपन-वेट मॉडल्स को अपनाने में वृद्धि" को दिया । बाजार की प्रतिक्रिया केवल मूल्य निर्धारण तक सीमित नहीं थी: Jefferies ने यह भी तर्क दिया कि गिरती टोकन लागत AI मांग और बुनियादी ढांचे के निवेश को बढ़ा सकती है
।
Silicon Data के सार्वजनिक सूचकांक ने 27 जुलाई को $1.43 दिखाया, जबकि अगस्त की शुरुआत में $1.20 की सूचना दी गई, जो OpenAI और DeepSeek घोषणाओं के कारण जुलाई के अंत/अगस्त की शुरुआत में तेज वृद्धि का सुझाव देता है । सूचकांक कीमतों और उपयोग को मिलाता है, जिसका अर्थ है कि गिरावट या तो सूची मूल्यों में गिरावट या सस्ते मॉडलों की ओर मांग में बदलाव को दर्शा सकती है — Silicon Data ने स्वयं इसे शुद्ध मूल्य टैग के रूप में पढ़ने के खिलाफ चेतावनी दी है
।
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
एंटरप्राइज AI इन्फ्रेंस लागत अगस्त 2026 की शुरुआत में $1.16–$1.18 प्रति मिलियन टोकन के साथ साल के सबसे निचले स्तर पर पहुंच गई, जो 31 मई को $2.04 से 43% कम है।
एंटरप्राइज AI इन्फ्रेंस लागत अगस्त 2026 की शुरुआत में $1.16–$1.18 प्रति मिलियन टोकन के साथ साल के सबसे निचले स्तर पर पहुंच गई, जो 31 मई को $2.04 से 43% कम है। OpenAI ने 30 जुलाई को GPT 5.6 Luna और Terra की कीमतों में क्रमशः 80% और 20% की कटौती की, जबकि DeepSeek ने 31 जुलाई को V4 Flash 0731 को $0.14/$0.28 प्रति मिलियन टोकन पर लॉन्च किया।
Anthropic का Claude Opus 5 24 जुलाई को $5/$25 प्रति मिलियन टोकन पर लॉन्च हुआ, जिसने बाजार में प्रतिस्पर्धात्मक दबाव बढ़ाया और कीमतों को और कम करने में मदद की।