OpenAI ने GPT-5.6 Sol की API कीमत घटाई, AWS Bedrock ने जोड़े नए क्रॉस-रीजन विकल्प
GPT 5.6 Sol की शॉर्ट कॉन्टेक्स्ट API कीमत इनपुट के लिए $5 से घटकर $4 और आउटपुट के लिए $30 से घटकर $20 प्रति 10 लाख टोकन हो गई है। [1] यह कटौती Luna की 80% और Terra की 20% पिछली कीमत कटौती से छोटी है; Sol के लिए OpenAI ने Fast मोड भी दिया है, जो सामान्य प्रोसेसिंग से 2.5 गुना तक तेज है। [8] OpenRouter पर प्रदर्शित So...
GPT 5.6 Sol की शॉर्ट कॉन्टेक्स्ट API कीमत इनपुट के लिए $5 से घटकर $4 और आउटपुट के लिए $30 से घटकर $20 प्रति 10 लाख टोकन हो गई है। [1]
यह कटौती Luna की 80% और Terra की 20% पिछली कीमत कटौती से छोटी है; Sol के लिए OpenAI ने Fast मोड भी दिया है, जो सामान्य प्रोसेसिंग से 2.5 गुना तक तेज है। [8]
OpenRouter पर प्रदर्शित Sol दरें OpenAI की नई डायरेक्ट दरों की तुलना में आधी हैं, लेकिन इन्हें रूट विशिष्ट या प्रमोशनल कीमतों के रूप में देखना चाहिए। [7]
Amazon Bedrock अब Sol, Terra और Luna के लिए In Region, Geo cross Region और Global cross Region inference के साथ Responses, Converse और Chat Completions APIs सपोर्ट करता है। [5]
What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and TerraAI-generated editorial hero image for What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and Terra.
AI संकेत
Create a landscape editorial hero image for this Studio Global article: What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and Terra. Article summary: OpenAI has cut direct GPT‑5.6 Sol API pricing to $4/M short context input tokens and $20/M output tokens, from the earlier $5/M and $30/M—20% lower on input and about 33% lower on output.. Topic tags: general web, openai, ai, productivity, code. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thum
openai.com
OpenAI ने अपने टॉप-टियर मॉडल GPT-5.6 Sol की डायरेक्ट API और पात्र क्रेडिट कीमतों में कटौती की है। शॉर्ट-कॉन्टेक्स्ट इस्तेमाल में इनपुट टोकन की कीमत अब $4 प्रति 10 लाख टोकन है, जो पहले $5 थी। आउटपुट की कीमत $20 प्रति 10 लाख टोकन हो गई है, जबकि पहले यह $30 थी। यानी इनपुट 20% और आउटपुट करीब 33% सस्ता हुआ है। लंबे कॉन्टेक्स्ट के लिए OpenAI की सूची में इनपुट $8 और आउटपुट $30 प्रति 10 लाख टोकन है।
यह बदलाव कम-से-कम 21 नवंबर 2026 तक लागू प्रमोशनल कीमत के रूप में बताया गया है। ChatGPT के Pro, Plus और Business सब्सक्रिप्शन की कीमतों में बदलाव नहीं किया गया है।
Sol की कीमत में कटौती Luna और Terra से कैसे अलग है?
जुलाई में OpenAI ने GPT-5.6 परिवार के सस्ते मॉडलों पर कहीं अधिक आक्रामक कदम उठाया था:
GPT-5.6 Luna: कीमत में 80% कमी; नई दर $0.20 इनपुट और $1.20 आउटपुट प्रति 10 लाख टोकन।
GPT-5.6 Terra: कीमत में 20% कमी; नई दर $2 इनपुट और $12 आउटपुट प्रति 10 लाख टोकन।
GPT-5.6 Sol: अब डायरेक्ट API में $4 इनपुट और $20 आउटपुट; यह नई कटौती है, लेकिन प्रतिशत के लिहाज से Luna और Terra की पिछली कटौतियों से छोटी है।
Sol के लिए OpenAI ने साथ ही Fast मोड पेश किया है। यह Standard प्रोसेसिंग की तुलना में 2.5 गुना तक तेज गति दे सकता है, लेकिन इसकी कीमत Standard दर से दोगुनी है। मॉडल की बुद्धिमत्ता में बदलाव नहीं होता।
Studio Global AI
अपना शोध जारी रखें
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
"OpenAI ने GPT-5.6 Sol की API कीमत घटाई, AWS Bedrock ने जोड़े नए क्रॉस-रीजन विकल्प" का संक्षिप्त उत्तर क्या है?
GPT 5.6 Sol की शॉर्ट कॉन्टेक्स्ट API कीमत इनपुट के लिए $5 से घटकर $4 और आउटपुट के लिए $30 से घटकर $20 प्रति 10 लाख टोकन हो गई है। [1]
सबसे पहले सत्यापित करने योग्य मुख्य बिंदु क्या हैं?
GPT 5.6 Sol की शॉर्ट कॉन्टेक्स्ट API कीमत इनपुट के लिए $5 से घटकर $4 और आउटपुट के लिए $30 से घटकर $20 प्रति 10 लाख टोकन हो गई है। [1] यह कटौती Luna की 80% और Terra की 20% पिछली कीमत कटौती से छोटी है; Sol के लिए OpenAI ने Fast मोड भी दिया है, जो सामान्य प्रोसेसिंग से 2.5 गुना तक तेज है। [8]
मुझे अभ्यास में आगे क्या करना चाहिए?
OpenRouter पर प्रदर्शित Sol दरें OpenAI की नई डायरेक्ट दरों की तुलना में आधी हैं, लेकिन इन्हें रूट विशिष्ट या प्रमोशनल कीमतों के रूप में देखना चाहिए। [7]
GPT-5.6 Sol को फ्लैगशिप मॉडल क्यों माना जा रहा है?
Sol GPT-5.6 परिवार का सबसे महंगा और उच्चतम स्तर का मॉडल है। OpenAI इसे उन कामों के लिए अलग करता है जहां बेहतर reasoning, प्रीमियम throughput और जटिल एजेंटिक वर्कलोड महत्वपूर्ण हैं। इसके मुकाबले:
Terra लागत, क्षमता और प्रदर्शन के बीच संतुलन वाले सामान्य प्रोडक्शन वर्कलोड के लिए है।
Luna बड़े पैमाने, कम latency और कम लागत वाले कामों—जैसे classification, summarization और routing—के लिए है।
इसलिए Sol की कीमत घटने के बाद भी उसकी पारिवारिक स्थिति नहीं बदली: यह अब भी सबसे महंगा और सबसे प्रीमियम विकल्प है। OpenAI का संदेश यह है कि दक्षता का लाभ केवल मार्जिन बढ़ाने के लिए नहीं, बल्कि कम कीमत और तेज गति के रूप में ग्राहकों तक भी पहुंचाया जा रहा है।
OpenRouter और AWS Bedrock से तुलना
OpenRouter पर GPT-5.6 Sol की प्रदर्शित कीमत $2 प्रति 10 लाख इनपुट टोकन और $10 प्रति 10 लाख आउटपुट टोकन है—OpenAI की नई डायरेक्ट शॉर्ट-कॉन्टेक्स्ट दरों का लगभग आधा।
यह डेवलपर और कंपनियों के लिए खर्च घटाने का आकर्षक विकल्प हो सकता है, लेकिन aggregator की कीमत को हमेशा सार्वभौमिक या स्थायी list price नहीं मानना चाहिए। रूट, प्रमोशन, BYOK व्यवस्था, caching, rate limits और सेवा-शर्तों के अनुसार वास्तविक लागत बदल सकती है।
Amazon Bedrock पर कीमत routing विकल्प पर निर्भर करती है। GPT-5.6 Sol के लिए शॉर्ट-कॉन्टेक्स्ट Global cross-Region प्रोफाइल की दर $5 इनपुट और $30 आउटपुट प्रति 10 लाख टोकन है। In-Region और Geographic cross-Region दरें $5.50 इनपुट और $33 आउटपुट हैं।
Amazon Bedrock में क्या बदला?
AWS ने GPT-5.6 Sol, Terra और Luna को bedrock-runtime endpoint पर Responses, Converse और Chat Completions APIs के साथ उपलब्ध कराया है। इनके लिए Geographic और Global cross-Region inference भी जोड़ा गया है।
In-Region inference
इस विकल्प में अनुरोध चुने गए AWS Region के भीतर ही प्रोसेस होता है। शुरुआत में Sol US East (N. Virginia) और US East (Ohio) में उपलब्ध था। Terra और Luna इन दोनों के साथ US West (Oregon) में भी उपलब्ध थे।
यह विकल्प उन संगठनों के लिए उपयोगी है जिन्हें डेटा-प्रोसेसिंग को एक निश्चित Region तक सीमित रखना है।
Geographic cross-Region inference
Geo cross-Region inference अनुरोध को किसी एक Region में बांधने के बजाय तय भौगोलिक क्षेत्र के भीतर उपलब्ध क्षमता पर भेज सकता है। ऐसे क्षेत्र US, EU, Japan या Australia हो सकते हैं। इससे कंपनियों को एक ही geography के भीतर अधिक capacity मिलती है, जबकि डेटा-रेजिडेंसी की सीमा भी बरकरार रह सकती है।
Global cross-Region inference
Global प्रोफाइल, जिसका ID global. से शुरू होता है, अनुरोध को उस किसी भी समर्थित commercial AWS Region में भेज सकता है जहां मॉडल उपलब्ध हो। AWS यह routing real-time capacity के आधार पर करता है। जब किसी संगठन पर सख्त भौगोलिक पाबंदी नहीं होती, तब यह सबसे बड़ा capacity pool और बेहतर throughput दे सकता है।
नया capacity और failover लाभ
व्यावहारिक तौर पर इसका मतलब यह है कि कंपनियों को किसी एक Region की क्षमता या अचानक बढ़ी मांग से अकेले नहीं जूझना पड़ेगा। AWS GPT-5.6 Sol के लिए प्रत्येक समर्थित Region में cross-Region inference की 1 करोड़ टोकन प्रति मिनट quota सूचीबद्ध करता है। यह quota अनुरोधों में इस्तेमाल हुए इनपुट और आउटपुट टोकन के संयुक्त योग पर आधारित है।
इनपुट, कॉन्टेक्स्ट और API सपोर्ट
Bedrock पर GPT-5.6 परिवार में निम्न सुविधाएं उपलब्ध हैं:
टेक्स्ट और इमेज इनपुट
टेक्स्ट आउटपुट
Prompt caching
अधिकतम 10 लाख टोकन का context window
272K short-context pricing tier
Responses API
Converse API
Chat Completions API
10 लाख टोकन का context window लंबे दस्तावेजों, बड़े codebase और multi-turn agent history को एक ही अनुरोध में संभालने की संभावना बढ़ाता है। हालांकि, बड़े context का इस्तेमाल लागत और latency दोनों को प्रभावित कर सकता है।
2026 की AI price war का संकेत
इन बदलावों से frontier AI बाजार में प्रतिस्पर्धा का रुख साफ दिखता है। पहले OpenAI ने Luna और Terra जैसे निचले tiers की कीमतों में बड़ी कटौती की। अब Sol की कीमत भी कम की गई है, जबकि वैकल्पिक चैनलों पर इससे पहले ही भारी छूट दिखाई जा रही थी। इससे खरीदारों का ध्यान केवल मॉडल की गुणवत्ता पर नहीं, बल्कि कुल लागत, throughput, latency और खरीद के तरीके पर भी जाएगा।
कंपनियों के लिए सबसे सस्ता token rate हमेशा सबसे अच्छा सौदा नहीं होता। Direct OpenAI API, Amazon Bedrock और aggregators की तुलना करते समय इन बिंदुओं की जांच जरूरी है:
अनुबंध और promotional pricing की अवधि
डेटा का इस्तेमाल और उसका भौगोलिक स्थान
मॉडल version की समानता
rate limits और quota
prompt caching का व्यवहार
latency और throughput की गारंटी
cross-Region routing से जुड़े compliance नियम
Bedrock का फायदा केवल token कीमत नहीं है। AWS-native billing, IAM controls, Region या geography चुनने की सुविधा और capacity congestion के दौरान routing resilience इसके अतिरिक्त लाभ हैं। दूसरी ओर, Global routing उन कंपनियों के लिए उपयुक्त नहीं हो सकती जिनका डेटा किसी निश्चित देश या geography से बाहर प्रोसेस नहीं किया जा सकता।
निष्कर्ष यही है कि GPT-5.6 Sol की कीमत कटौती AI inference को लगातार सस्ता और प्रतिस्पर्धी बना रही है, लेकिन enterprise खरीद का फैसला केवल headline price पर नहीं होना चाहिए। सही विकल्प वह होगा जो मॉडल की गुणवत्ता, वास्तविक workload cost, गति, डेटा-नियमों और सेवा की विश्वसनीयता के बीच संतुलन बनाए।