صدر إعلان OpenAI الخاص بالواجهة البرمجية في 10 سبتمبر 2026، وليس 11 سبتمبر. GPT‑Live‑1 نموذج صوتي كامل الازدواج يستمع ويتحدث بالتزامن، ليجعل وكلاء الصوت أقرب إلى إيقاع الحوار الطبيعي.
نشر بواسطةتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
أعلنت OpenAI عن إتاحة GPT‑Live‑1 في واجهتها البرمجية في 10 سبتمبر 2026، لا في 11 سبتمبر. وقدمت الشركة النموذج بوصفه طبقة صوتية متاحة على نطاق عام وبـ«ازدواج كامل» (Full Duplex)، صُممت لجعل وكلاء الصوت أكثر طبيعية عبر الاستماع والتحدث في الوقت نفسه، بدلاً من انتظار اكتمال كل دور في المحادثة. 3
تعتمد كثير من تطبيقات المحادثة الصوتية التقليدية على سلسلة من ثلاث مراحل: تحويل الكلام إلى نص، ثم تمرير النص إلى نموذج لغوي أو نموذج استدلال، ثم تحويل الرد النصي إلى كلام. كل انتقال بين هذه المراحل قد يضيف تأخيراً، وقد يفقد النظام إشارات مهمة مثل التوقيت وسياق الحديث وإيقاع المحادثة. أما GPT‑Live‑1 فيجمع الاستماع والتحدث في نموذج صوتي واحد. 3
وبذلك يستطيع النموذج التعامل مع المقاطعات وإشارات التأكيد أثناء وقوعها، فيما يتولى نموذج خلفي مقترن به مهام الاستدلال الأعمق أو استخدام الأدوات في الخلفية. 3
ويمكن للمطورين اختيار نموذج الخلفية، سواء من نماذج OpenAI مثل GPT‑6 Astra أو من نموذج تابع لطرف ثالث، بما يتيح الموازنة بين قدرات الاستدلال والسرعة والتكلفة وفقاً لحالة الاستخدام. 3
أشارت OpenAI إلى عناصر تحكم عبر تعليمات النظام لضبط النبرة وسرعة الكلام وأسلوب المحادثة. كما أبرزت إمكانات للنشر عبر الهاتف، والتعامل مع ضوضاء الخلفية والصمت، وتحسين موثوقية الجلسات الطويلة، وإتاحة النصوص المفرغة والردود النصية، والتعرف على السلاسل الأبجدية الرقمية، وترجيح كلمات مفتاحية محددة. 3
تبلغ تكلفة جلسات GPT‑Live‑1 الصوتية 0.05 دولار للدقيقة، وتُحتسب بالثانية من دون تقريب مدة الاستخدام إلى دقيقة كاملة. 2
لكن هذه التكلفة تخص الطبقة الصوتية فقط؛ إذ تُفرض رسوم استخدام النموذج الخلفي والأدوات بشكل منفصل. لذلك تتكون التكلفة الفعلية من رسم الجلسة الصوتية، إضافة إلى رسوم النموذج والأدوات التي يختارها المطور. 2
ولا تكفي الأدلة المتاحة لإثبات تفاصيل مزعومة عن وصول مؤسسي مُدار باسم «Presence»، أو ادعاء محدد بشأن توسيع دعم اللهجات واللكنات واللغات؛ لذا ينبغي التعامل مع هذه النقاط على أنها غير مؤكدة من المصادر المقدمة.
قالت OpenAI إن GPT‑Live‑1 حقق تحسناً قدره 30 نقطة مئوية في معيار Full Duplex Bench مقارنة بـGPT‑Realtime‑2.1، وإن GPT‑Live‑1 عند إقرانه بـGPT‑6 Astra وبمستوى استدلال متوسط احتل المركز الأول في معيار Tau3. 3
أما أرقام زمن الاستجابة الدقيقة المتداولة، وكذلك نسب النجاح التفصيلية في Tau3، فلا تظهر مستقلة في الأدلة المتاحة هنا؛ لذلك لا يمكن تأكيدها من هذه المصادر وحدها.
قالت Yelp إن دمج GPT‑Live‑1 في خدمتي Yelp Host وHatch حسن تبادل الأدوار في الحديث والدقة مقارنة بهندستها الصوتية السابقة. وفي مكالمات الحجوزات وطلبات الطعام، أشارت إلى تحسن ملحوظ في معدلات معالجة المكالمات، وإلى أن المتصلين صاروا يتحدثون بعبارات أطول وأكثر طبيعية. 3
وذكرت Speak أن النموذج منح متعلمي اللغات وقتاً أطول للتفكير قبل رد المدرس الافتراضي، ما خفّض المقاطعات بنحو 80% مقارنة بالأنظمة السابقة المعتمدة على الأدوار المتتابعة. 3
كما قال مؤسس مشارك ومدير تقني في شركة رعاية صحية إن استبدال البنية المتسلسلة القديمة بــGPT‑Live‑1 بسط قاعدة الشيفرة بنسبة 80% وأزال 23 ألف سطر برمجي، بما أتاح محادثات آنية أكثر طبيعية مع المرضى. 3
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
صدر إعلان OpenAI الخاص بالواجهة البرمجية في 10 سبتمبر 2026، وليس 11 سبتمبر.
صدر إعلان OpenAI الخاص بالواجهة البرمجية في 10 سبتمبر 2026، وليس 11 سبتمبر. GPT‑Live‑1 نموذج صوتي كامل الازدواج يستمع ويتحدث بالتزامن، ليجعل وكلاء الصوت أقرب إلى إيقاع الحوار الطبيعي.
بدلاً من فصل تحويل الكلام إلى نص والاستدلال وتوليد الصوت، يجمع النموذج الاستماع والتحدث في طبقة صوتية واحدة.