OpenAI ने GPT Live 1 को 10 सितंबर 2026 को API में सामान्य उपलब्धता के साथ लॉन्च किया। यह मॉडल एक साथ सुन और बोल सकता है, जबकि अलग बैकएंड मॉडल रीजनिंग और टूल्स संभालता है। [1][16] फुल डुप्लेक्स डिजाइन का लक्ष्य बातचीत में ठहराव, बीच में टोकने, छोटी सहमति सूचक प्रतिक्रियाओं और बदलते संदर्भ को अधिक स्वाभाविक ढंग से संभ...
प्रकाशितकर्ताGPT-5.6 Terra से संपादितGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT-Live-1 full-duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11. It introduced GPT‑Live‑1 as a generally available, full‑duplex voice layer: a model intended to make voice agents more natural by listening and spe. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
OpenAI ने GPT-Live-1 को 10 सितंबर 2026 को API में जनरल अवेलेबिलिटी के साथ जारी किया था, 11 सितंबर को नहीं। यह डेवलपर्स के लिए ऐसा वॉइस लेयर है जो बातचीत को अलग-अलग, सख्त “बारी” में लेने के बजाय एक साथ सुन और बोल सकता है। 1
16
पारंपरिक वॉइस एजेंट अक्सर तीन चरणों की श्रृंखला पर चलते हैं: पहले स्पीच-टू-टेक्स्ट, फिर भाषा मॉडल से जवाब तैयार कराना, और अंत में टेक्स्ट-टू-स्पीच। GPT-Live-1 को रियल-टाइम बातचीत के लिए एक एकीकृत वॉइस लेयर के रूप में पेश किया गया है। 1
इसका अहम फर्क बातचीत की बारी संभालने में है। OpenAI के अनुसार, GPT-Live-1 एक साथ सुन और बोल सकता है, ठहराव व बोलने की गति में बदलाव समझ सकता है और तत्काल तय कर सकता है कि उसे जवाब देना है या सुनते रहना है। इसका उद्देश्य बीच में टोकने या छोटी सहमति-सूचक प्रतिक्रियाओं—जिन्हें बैकचैनल कहा जाता है—को त्रुटि की तरह नहीं, बल्कि सामान्य संवाद की तरह संभालना है। 1
9
15
इसका यह अर्थ नहीं कि वॉइस मॉडल को हर काम खुद ही करना होगा। बातचीत जारी रहते हुए कोई बैकएंड मॉडल या एजेंट गहरी रीजनिंग कर सकता है या टूल्स का उपयोग कर सकता है। OpenAI मॉडल के लिए Responses delegation और डेवलपर के अपने बैकएंड को जोड़ने के लिए client delegation उपलब्ध है। 1
16
GPT-Live-1 को फ्रंट-एंड बातचीत संभालने वाले लेयर की तरह देखा जा सकता है: सुनना, बोलना और संवाद का समय नियंत्रित करना। दूसरी ओर, बैकएंड ज्यादा जटिल तर्क, जानकारी ढूंढना, वर्कफ़्लो चलाना या टूल कॉल जैसे काम कर सकता है। OpenAI के प्रोडक्ट नोट्स में कठिन खोज और रीजनिंग वाले कामों के लिए GPT-6 Astra का उल्लेख है; API डेवलपर client delegation के जरिए अपना बैकएंड भी जोड़ सकते हैं। 4
16
व्यावहारिक रूप से इसका विभाजन ऐसा है:
OpenAI ने इस API रिलीज के साथ बेहतर निर्देश-अनुपालन, कस्टम वॉइस और टेलीफोनी सपोर्ट का भी उल्लेख किया है। 13
GPT-Live-1 वॉइस सेशन की कीमत $0.05 प्रति मिनट है। बिलिंग प्रति सेकंड होती है; अगले पूरे मिनट तक राउंड-अप नहीं किया जाता। 16
18
हालांकि, यह पूरी वॉइस-एजेंट सेवा की लागत नहीं है। बैकएंड मॉडल का उपयोग और टूल्स के उपयोग का शुल्क अलग लिया जाएगा। इसलिए प्रोडक्शन बजट बनाते समय कॉल की अवधि के साथ-साथ बैकएंड पर होने वाली रीजनिंग और टूल कार्यों को भी जोड़ना होगा। 16
18
OpenAI ने कहा कि GPT-Live-1 ने उसके Full Duplex Bench पर GPT-Realtime-2.1 की तुलना में 30 प्रतिशत अंक का सुधार दर्ज किया। कंपनी ने यह भी बताया कि मध्यम रीजनिंग प्रयास के साथ GPT-6 Astra से जोड़े जाने पर GPT-Live-1 ने Tau3 में पहला स्थान हासिल किया। 1
लेकिन उपलब्ध सामग्री प्रश्न में दिए गए टर्न-टेकिंग लेटेंसी के सटीक आंकड़ों या Tau3 पास-रेट की सटीक तुलना को स्वतंत्र रूप से पुष्ट नहीं करती। इसलिए उन विशिष्ट आंकड़ों को यहां सत्यापित नहीं माना जाना चाहिए।
OpenAI ने अधिक प्राकृतिक टर्न-टेकिंग के लाभ के उदाहरण के तौर पर कुछ शुरुआती प्रोडक्शन डिप्लॉयमेंट साझा किए:
ये नतीजे संबंधित कंपनियों की अपनी रिपोर्ट हैं, स्वतंत्र आकलन नहीं। इन्हें तैनाती के उदाहरण के रूप में देखना चाहिए, हर उपयोग-मामले के लिए प्रदर्शन की गारंटी के रूप में नहीं।
मौजूदा सामग्री “Presence” नाम के किसी प्रबंधित एंटरप्राइज़ प्रोडक्ट के जरिए पहुंच के दावे को पुष्ट नहीं करती। इसी तरह, इस API लॉन्च में एक्सेंट, बोलियों या भाषाओं के किसी खास विस्तार की पुष्टि भी उपलब्ध साक्ष्यों से नहीं होती। खरीद या इंप्लीमेंटेशन का फैसला लेने से पहले इन बिंदुओं को OpenAI के नवीनतम दस्तावेज़ों में जांचना चाहिए।
GPT-Live-1 की बड़ी बात इसकी संरचना है: यह API में फुल-डुप्लेक्स वॉइस बातचीत देता है, ताकि एजेंट स्वाभाविक रूप से सुनता और बोलता रहे, जबकि धीमी या जटिल रीजनिंग और टूल्स का काम अलग सिस्टम संभाल ले। वॉइस लेयर की लागत $0.05 प्रति मिनट और प्रति-सेकंड बिलिंग के साथ स्पष्ट है, लेकिन वास्तविक कुल खर्च चुने गए बैकएंड मॉडल और टूल्स पर भी निर्भर करेगा। 1
16
18
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
OpenAI ने GPT Live 1 को 10 सितंबर 2026 को API में सामान्य उपलब्धता के साथ लॉन्च किया। यह मॉडल एक साथ सुन और बोल सकता है, जबकि अलग बैकएंड मॉडल रीजनिंग और टूल्स संभालता है। [1][16]
OpenAI ने GPT Live 1 को 10 सितंबर 2026 को API में सामान्य उपलब्धता के साथ लॉन्च किया। यह मॉडल एक साथ सुन और बोल सकता है, जबकि अलग बैकएंड मॉडल रीजनिंग और टूल्स संभालता है। [1][16] फुल डुप्लेक्स डिजाइन का लक्ष्य बातचीत में ठहराव, बीच में टोकने, छोटी सहमति सूचक प्रतिक्रियाओं और बदलते संदर्भ को अधिक स्वाभाविक ढंग से संभालना है। [1][9][15]
वॉइस सेशन की कीमत $0.05 प्रति मिनट है और बिलिंग प्रति सेकंड होती है। लेकिन बैकएंड मॉडल और टूल्स का खर्च अलग से जुड़ता है। [16][18]