Duyuru 11 Eylül’de değil, 10 Eylül 2026’da yapıldı. GPT Live 1, aynı anda dinleyip konuşabilen tam çift yönlü bir ses modeli olarak API’ye sunuldu.
YayımlayanGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
OpenAI’nin API duyurusu 11 Eylül’de değil, 10 Eylül 2026’da yayımlandı. Şirket, GPT-Live-1’i sesli uygulamalar ve iş akışları geliştirenler için API’de kullanıma açtı. Modelin temel vaadi, konuşmanın tek tek turlara bölündüğü yapı yerine, insan sohbetine daha yakın biçimde aynı anda dinleyip konuşabilmesi. 3
Geleneksel sesli ajanlar genellikle üç aşamalı, zincirleme bir yapı kullanır: önce ses konuşmayı metne çevirme (speech-to-text), ardından bir dil ya da akıl yürütme modeli, son olarak metinden konuşmaya dönüştürme (text-to-speech). Bu aşamalar arasındaki her aktarım gecikme yaratabilir; konuşmanın zamanlaması, bağlamı ve doğal ritmi de kısmen kaybolabilir. 3
GPT-Live-1 ise dinleme ve konuşma görevlerini tek bir ses modelinde birleştiriyor. Böylece kullanıcı araya girdiğinde, kısa bir onay verdiğinde ya da konuşmasını sürdürdüğünde sistemin bunu gerçekleştiği anda ele alması amaçlanıyor. Daha karmaşık akıl yürütme veya araç kullanımı ise arka planda bağlı bir model tarafından yürütülebiliyor. 3
Geliştiriciler bu arka uç için GPT-6 Astra gibi bir OpenAI modelini ya da üçüncü taraf bir modeli seçebiliyor. Bu seçim, uygulamanın ihtiyaçlarına göre akıl yürütme düzeyi, yanıt hızı ve maliyet arasında denge kurmayı sağlıyor. 3
OpenAI ayrıca sistem istemleri üzerinden ses tonu, konuşma hızı ve diyalog tarzı kontrolü sunduğunu belirtti. Telefon altyapısına dağıtım, arka plan gürültüsü ve sessizliği ele alma, uzun görüşmelerde güvenilirlik, konuşma dökümleri ve yanıt metni, alfasayısal ifadeleri tanıma ve anahtar kelime önyargılaması da vurgulanan yetenekler arasında yer aldı. 3
GPT-Live-1 ses oturumları dakika başına 0,05 ABD doları ücretlendiriliyor. Ücretlendirme tam dakikaya yuvarlanmıyor; saniye bazında yapılıyor. 2
Ancak bu ücret yalnızca ses katmanını kapsıyor. Seçilen arka uç modelinin kullanımı ve çağrı sırasında kullanılan araçlar ayrıca faturalandırılıyor. Bu nedenle toplam maliyet, ses oturumu bedeline ek olarak model ve araç tüketimine bağlı olacak. 2
Sağlanan kaynaklar, yönetilen “Presence” kurumsal erişim ayrıntıları ya da aksan, lehçe ve dil kapsamının genişletildiği yönündeki belirli iddiaları doğrulamıyor.
OpenAI, GPT-Live-1’in GPT-Realtime-2.1’e kıyasla Full Duplex Bench’te 30 yüzde puanlık gelişme kaydettiğini açıkladı. Şirket ayrıca, orta düzey akıl yürütme ayarıyla GPT-6 Astra’ya bağlanan GPT-Live-1’in Tau3 sıralamasında ilk sıraya yerleştiğini bildirdi. 3
Bununla birlikte, 1,41 saniye ile 0,798 saniye arasındaki gecikme değerleri veya Tau3 için yüzde 86,2’ye karşı yüzde 45,7 geçiş oranları gibi kesin rakamlar sağlanan kanıtlarda bağımsız biçimde yer almıyor. Bu nedenle bu sayılar doğrulanmış kabul edilmemeli.
Yelp, GPT-Live-1’i Yelp Host ve Hatch ürünlerine entegre ettikten sonra önceki ses mimarisine kıyasla konuşma sırası yönetimi ve doğrulukta iyileşme gördüğünü söyledi. Rezervasyon ve yemek siparişi görüşmelerinde çağrı yönetim oranlarının anlamlı biçimde yükseldiğini; arayanların daha bütünlüklü ve doğal ifadeler kullandığını bildirdi. 3
Dil öğrenme uygulaması Speak ise modelin, eğitmenin yanıt vermesinden önce öğrencilere daha fazla düşünme süresi tanıdığını; önceki tur bazlı sistemlere göre kesintileri yaklaşık yüzde 80 azalttığını aktardı. 3
Bir sağlık teknolojisi şirketinin kurucu ortağı ve CTO’su da zincirleme yapıyı değiştirmelerinin kod tabanını yüzde 80 sadeleştirdiğini ve 23.000 satır kodu ortadan kaldırdığını; bunun daha doğal, gerçek zamanlı hasta görüşmelerini mümkün kıldığını ifade etti. 3
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Duyuru 11 Eylül’de değil, 10 Eylül 2026’da yapıldı.
Duyuru 11 Eylül’de değil, 10 Eylül 2026’da yapıldı. GPT Live 1, aynı anda dinleyip konuşabilen tam çift yönlü bir ses modeli olarak API’ye sunuldu.
Model, klasik STT–dil modeli–TTS zincirindeki aktarımları azaltarak daha doğal sıra alma ve kesinti yönetimi hedefliyor.