Pengumuman API OpenAI bertanggal 10 September 2026, bukan 11 September. GPT Live 1 adalah lapisan suara full duplex yang dirancang agar agen suara dapat mendengar dan berbicara secara bersamaan.
Diterbitkan olehGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
Pengumuman API OpenAI itu bertanggal 10 September 2026, bukan 11 September. OpenAI memperkenalkan GPT-Live-1 sebagai model suara full-duplex yang tersedia secara umum untuk pengembang. Intinya, model ini ditujukan untuk membuat agen suara terasa lebih natural karena dapat mendengarkan dan berbicara pada saat yang sama, bukan menunggu percakapan selesai per giliran. 3
Agen suara tradisional biasanya memakai rangkaian tiga tahap: speech-to-text untuk mengubah suara menjadi teks, model bahasa atau penalaran untuk menyusun respons, lalu text-to-speech untuk mengubah respons menjadi suara. Setiap perpindahan tahap dapat menambah jeda serta berisiko menghilangkan konteks waktu dan ritme percakapan. GPT-Live-1 menyatukan fungsi mendengar dan berbicara dalam satu model suara. 3
Karena bersifat full-duplex, GPT-Live-1 dapat menangani interupsi pengguna maupun respons singkat seperti tanda setuju saat percakapan berlangsung. Sementara itu, penalaran yang lebih mendalam atau penggunaan alat dapat diproses di latar belakang oleh model backend yang dipasangkan dengannya. 3
Pengembang dapat mendelegasikan tugas tersebut ke backend OpenAI, seperti GPT-6 Astra, atau ke model pihak ketiga. Pilihan ini memungkinkan pengembang menyesuaikan keseimbangan kemampuan penalaran, kecepatan, dan biaya untuk kebutuhan aplikasinya. 3
OpenAI juga menyoroti kontrol melalui system prompt untuk mengatur nada bicara, tempo, dan gaya percakapan. Fitur lain yang disebut mencakup penerapan untuk telepon, penanganan kebisingan latar dan keheningan, keandalan sesi yang lebih panjang, transkrip atau teks respons, pengenalan karakter alfanumerik, serta keyword biasing. 3
Sesi suara GPT-Live-1 dikenai tarif US$0,05 per menit dan ditagihkan per detik, tanpa pembulatan ke satu menit penuh. 2
Biaya tersebut hanya untuk lapisan suara. Pemakaian model backend dan alat ditagihkan secara terpisah, sehingga total biaya bergantung pula pada model dan alat yang dipilih pengembang. 2
Bukti yang tersedia tidak mendukung rincian akses perusahaan terkelola “Presence” maupun klaim spesifik tentang perluasan aksen, dialek, dan bahasa. Karena itu, kedua hal tersebut tidak dapat dipastikan dari sumber yang diberikan.
OpenAI melaporkan peningkatan 30 poin persentase pada Full Duplex Bench dibanding GPT-Realtime-2.1. Dalam pengujian Tau3, GPT-Live-1 yang dipasangkan dengan GPT-6 Astra pada tingkat penalaran menengah disebut menempati peringkat pertama. 3
Namun, sumber yang disediakan tidak menampilkan secara independen angka latensi spesifik 1,41 detik versus 0,798 detik maupun tingkat kelulusan Tau3 86,2% versus 45,7%. Angka-angka tersebut sebaiknya diperlakukan sebagai belum terverifikasi berdasarkan bukti yang tersedia.
Yelp menyatakan integrasi GPT-Live-1 pada Yelp Host dan Hatch meningkatkan pengelolaan giliran bicara serta akurasi dibanding arsitektur suara sebelumnya. Untuk panggilan reservasi dan pemesanan makanan, perusahaan itu melaporkan kenaikan berarti dalam tingkat penanganan panggilan dan pengguna berbicara dengan ujaran yang lebih lengkap serta natural. 3
Speak mengatakan model tersebut memberi pelajar bahasa lebih banyak waktu untuk berpikir sebelum tutor merespons, sehingga interupsi berkurang hampir 80% dibanding sistem berbasis giliran sebelumnya. 3
Seorang pendiri bersama sekaligus CTO perusahaan layanan kesehatan juga mengatakan bahwa penggantian implementasi berantai menyederhanakan basis kode hingga 80% dan menghapus 23.000 baris kode, yang disebut memungkinkan percakapan pasien waktu nyata terasa lebih alami. 3
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Pengumuman API OpenAI bertanggal 10 September 2026, bukan 11 September.
Pengumuman API OpenAI bertanggal 10 September 2026, bukan 11 September. GPT Live 1 adalah lapisan suara full duplex yang dirancang agar agen suara dapat mendengar dan berbicara secara bersamaan.
Model ini menggantikan alur berantai speech to text, model bahasa, lalu text to speech dengan satu model suara terpadu.