OpenAI GPT-Live-1 और GPT-Live-1 मिनी: फुल-डुप्लेक्स वॉइस मॉडल जो एक साथ सुन और बोल सकते हैं
OpenAI ने 8 जुलाई 2026 को GPT Live 1 (पेड) और GPT Live 1 मिनी (फ्री) वैश्विक स्तर पर लॉन्च किया, जो एडवांस्ड वॉइस मोड को बदलता है। ये फुल डुप्लेक्स आर्किटेक्चर पर बने हैं, यानी एक साथ सुन और बोल सकते हैं [1][2][3]। ये मॉडल बातचीत को और प्राकृतिक बनाते हैं: आप AI को बीच में टोक सकते हैं, वह 'ह्म्म' करके सुनने का संके...
OpenAI ने 8 जुलाई 2026 को GPT Live 1 (पेड) और GPT Live 1 मिनी (फ्री) वैश्विक स्तर पर लॉन्च किया, जो एडवांस्ड वॉइस मोड को बदलता है। ये फुल डुप्लेक्स आर्किटेक्चर पर बने हैं, यानी एक साथ सुन और बोल सकते हैं [1][2][3]।
ये मॉडल बातचीत को और प्राकृतिक बनाते हैं: आप AI को बीच में टोक सकते हैं, वह 'ह्म्म' करके सुनने का संकेत देता है, और जटिल सवालों को GPT 5.5 को भेजता है, जबकि वह आपसे बात करता रहता है [3][4][9]।
GPT Live बातचीत के दौरान AI जनरेटेड इमेज, डायग्राम या विज़ुअल दिखा सकता है, जिससे मौसम, स्टॉक या खेल जैसी चर्चा और रोचक हो जाती है [2][4][9]।
इस मॉडल को OpenAI के रिसर्च लीड कुंदन कुमार (Character.AI से आए) और प्रोडक्ट लीड अट्टी एलेटी ने विकसित किया है [4][6][9]।
Search & fact-check with cited sources for What is OpenAI's new GPT-Live-1 and GPT-Live-1 mini, how do their full-duplex voice capabilitiesAI-generated hero image for OpenAI's GPT-Live-1 and GPT-Live-1 mini voice models.
AI संकेत
Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is OpenAI's new GPT-Live-1 and GPT-Live-1 mini, how do their full-duplex voice capabilities. Article summary: Here is the complete fact-checked rundown.. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
openai.com
8 जुलाई 2026 को OpenAI ने GPT-Live नाम से वॉइस मॉडल का एक नया परिवार लॉन्च किया, जो AI असिस्टेंट के साथ बातचीत के तरीके को पूरी तरह बदल देता है। पिछले वॉइस असिस्टेंट की तरह 'पहले मैं बोलूं, फिर तुम बोलो' वाली बाध्यता खत्म हो गई है ।
Studio Global AI
अपना शोध जारी रखें
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
"OpenAI GPT-Live-1 और GPT-Live-1 मिनी: फुल-डुप्लेक्स वॉइस मॉडल जो एक साथ सुन और बोल सकते हैं" का संक्षिप्त उत्तर क्या है?
OpenAI ने 8 जुलाई 2026 को GPT Live 1 (पेड) और GPT Live 1 मिनी (फ्री) वैश्विक स्तर पर लॉन्च किया, जो एडवांस्ड वॉइस मोड को बदलता है। ये फुल डुप्लेक्स आर्किटेक्चर पर बने हैं, यानी एक साथ सुन और बोल सकते हैं [1][2][3]।
सबसे पहले सत्यापित करने योग्य मुख्य बिंदु क्या हैं?
OpenAI ने 8 जुलाई 2026 को GPT Live 1 (पेड) और GPT Live 1 मिनी (फ्री) वैश्विक स्तर पर लॉन्च किया, जो एडवांस्ड वॉइस मोड को बदलता है। ये फुल डुप्लेक्स आर्किटेक्चर पर बने हैं, यानी एक साथ सुन और बोल सकते हैं [1][2][3]। ये मॉडल बातचीत को और प्राकृतिक बनाते हैं: आप AI को बीच में टोक सकते हैं, वह 'ह्म्म' करके सुनने का संकेत देता है, और जटिल सवालों को GPT 5.5 को भेजता है, जबकि वह आपसे बात करता रहता है [3][4][9]।
मुझे अभ्यास में आगे क्या करना चाहिए?
GPT Live बातचीत के दौरान AI जनरेटेड इमेज, डायग्राम या विज़ुअल दिखा सकता है, जिससे मौसम, स्टॉक या खेल जैसी चर्चा और रोचक हो जाती है [2][4][9]।
GPT-Live-1 और GPT-Live-1 मिनी फुल-डुप्लेक्स आर्किटेक्चर पर बने हैं, जिसका मतलब है कि ये एक साथ सुन और बोल सकते हैं। यह बदलाव अब हर ChatGPT यूज़र के लिए उपलब्ध है ।
GPT-Live-1 और GPT-Live-1 मिनी क्या हैं?
GPT-Live दो वर्ज़न में आता है :
GPT-Live-1 — पेड ChatGPT टियर (Go, Plus, Pro) के लिए
GPT-Live-1 मिनी — फ्री टियर यूज़र्स के लिए
दोनों ही पिछले ChatGPT एडवांस्ड वॉइस मोड को रिप्लेस करते हैं। ये एक सच्चे फुल-डुप्लेक्स आर्किटेक्चर पर बने हैं जो लगातार इनकमिंग ऑडियो को प्रोसेस करते हुए अपना जवाब जनरेट कर सकते हैं। पुराने हाफ-डुप्लेक्स सिस्टम में मॉडल को पहले अपनी बात खत्म करनी पड़ती थी, तभी वह यूज़र को सुन पाता था ।
OpenAI का कहना है कि इंफ़रेंस की लागत इतनी कम हो गई है कि वॉइस फीचर की इकोनॉमिक्स अब संभव है, इसलिए यह फ्री यूज़र्स के लिए भी उपलब्ध है । लॉन्च के समय, GPT-Live रीज़निंग के लिए पीछे की ओर GPT-5.5 का उपयोग करता है ।
फुल-डुप्लेक्स वॉइस कैसे बेहतर बनाती है बातचीत?
फुल-डुप्लेक्स क्षमता वॉइस AI के अनुभव को तीन तरीकों से बदल देती है:
1. प्राकृतिक रुकावट और बातचीत का क्रम
मॉडल को आप बीच में टोक सकते हैं, और वह रुककर सुनेगा, न कि आप पर चिल्लाएगा। यह यूज़र के बीच में सोचने पर रुकने का इंतज़ार भी करता है । OpenAI के प्रोडक्ट लीड अट्टी एलेटी ने ब्रीफ़िंग में कहा: "यह एक फुल डुप्लेक्स मॉडल है" ।
जब आप बोलते रहते हैं, तो मॉडल 'ह्म्म' या 'हां' जैसे शब्दों से सुनने का संकेत दे सकता है, और जब आपको सोचने के लिए एक पल चाहिए, तो चुप रहता है ।
2. जटिल सवालों को समानांतर में रूट करना
जब GPT-Live को कोई मुश्किल सवाल पूछा जाता है, तो वह रीज़निंग को OpenAI के नवीनतम टेक्स्ट मॉडल (जैसे GPT-5.5) को समानांतर में सौंप देता है, जबकि GPT-Live खुद यूज़र के साथ बातचीत जारी रखता है । रिसर्च लीड कुंदन कुमार ने समझाया: "जब GPT-Live को किसी सवाल के लिए गहराई से सोचना होता है, तो वह अपनी रीज़निंग और जटिल कार्य GPT-5.5 को सौंप सकता है, जबकि GPT-Live अभी भी यूज़र के साथ बातचीत में रहता है" । इसका मतलब है कि यूज़र्स को भारी कार्यों के लिए वॉइस मॉडल का इंतज़ार नहीं करना पड़ता ।
3. बातचीत के दौरान AI-जनरेटेड विज़ुअल
GPT-Live बातचीत को और बेहतर बनाने के लिए ऑन-स्क्रीन विज़ुअल — इमेज, डायग्राम, या अन्य AI-जनरेटेड कंटेंट — दिखा सकता है, जो शुद्ध वॉइस चैट से आगे एक मल्टीमॉडल अनुभव बनाता है ।
ये सभी फीचर मिलकर बातचीत को एक प्राकृतिक मानवीय संवाद के करीब लाते हैं।
विकास का नेतृत्व किसने किया?
प्रेस ब्रीफ़िंग और मीडिया रिपोर्ट्स में दो मुख्य लोगों के नाम सामने आए हैं :
कुंदन कुमार — GPT-Live के रिसर्च लीड। वह मध्य 2025 में Character.AI से OpenAI में शामिल हुए और ऑडियो AI प्रोजेक्ट के मुख्य लीड हैं ।
अट्टी एलेटी — ChatGPT वॉइस के प्रोडक्ट लीड, जिन्होंने लॉन्च लाइवस्ट्रीम के दौरान मॉडल प्रस्तुत किया ।
जनवरी 2026 की शुरुआती रिपोर्ट्स में इंफ़्रास्ट्रक्चर लीड बेन न्यूहाउस और प्रोडक्ट मैनेजर जैकी शैनन का भी नाम ऑडियो AI पुनर्गठन में शामिल होने के लिए आया था ।
रोलआउट टाइमलाइन
8 जुलाई 2026 — वैश्विक लॉन्च सभी ChatGPT यूज़र्स (iOS, Android, और वेब) के लिए शुरू हुआ। GPT-Live-1 पेड सब्सक्राइबर्स के लिए और GPT-Live-1 मिनी फ्री यूज़र्स के लिए उपलब्ध है ।
7-8 जुलाई को OpenAI ने नए API रियलटाइम मॉडल (gpt-realtime-2.1 और gpt-realtime-2.1-mini) भी जारी किए, जिनमें बेहतर कैशिंग के कारण p95 लेटेंसी में 25% की कमी आई है ।
लॉन्च के समय एक सीमा यह है कि GPT-Live वर्तमान में वीडियो के साथ वॉइस को सपोर्ट नहीं करता ।
उसी सप्ताह की अन्य प्रमुख AI रिलीज़
OpenAI ने GPT-Live को एक बेहद व्यस्त सप्ताह के बीच लॉन्च किया, जब AI उद्योग में कई बड़ी घोषणाएं हुईं।
OpenAI — GPT-5.6 (Sol, Terra, और Luna वर्ज़न) का सार्वजनिक रिलीज़ 9 जुलाई 2026 को होने की उम्मीद थी ।
Anthropic — Claud Sonnet 5 में महत्वपूर्ण सुधार किया, जिसमें इंस्ट्रक्शन फॉलोइंग और कोड जनरेशन एक्यूरेसी बेहतर हुई । ट्रम्प प्रशासन ने Fable 5 और Mythos 5 मॉडल पर लगे एक्सपोर्ट कंट्रोल हटा दिए ।
Google DeepMind — NanoBanana 2 Lite लॉन्च किया, जो 4 सेकंड से कम समय में $0.034 प्रति 1,000 इमेज की दर से तस्वीरें बना सकता है ।
Meta — नियोक्लाउड सेवाएं देने की तैयारी में ।
SpaceXAI (xAI) — Anysphere (Cursor) के साथ साझेदारी में नए AI मॉडल जारी करने की तैयारी ।
thenews.com.pk
OpenAI unveils GPT-Live: ChatGPT can now listen and talk simultaneously