GPT Live 1 tersedia dalam API sejak 10 September 2026 pada harga AS$0.05 seminit bagi lapisan suara bahagian hadapan. Reka bentuk full duplex membolehkannya terus mendengar ketika bertutur, supaya gangguan, jeda dan respons ringkas dapat dikendalikan dengan lebih semula jadi.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is OpenAI’s GPT-Live-1 voice model, when was it released in the API and at what price, how does its full-duplex single-model architectu. Article summary: GPT‑Live‑1 is OpenAI’s flagship API voice model for natural, expressive, full‑duplex conversations: it can listen and generate speech concurrently, with smooth interruption handling. It entered the API on September 10, 2. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
GPT-Live-1 ialah model suara untuk pembangun daripada OpenAI, direka untuk menjadikan ejen suara lebih menyerupai perbualan langsung berbanding siri giliran rakaman yang kaku. Model ini tersedia dalam API pada 10 September 2026, dengan harga AS$0.05 seminit bagi lapisan suara bahagian hadapan. Kos untuk model penaakulan, alatan dan infrastruktur yang disambungkan di belakangnya pula dicaj secara berasingan. 3
5
Banyak ejen suara menggunakan rantaian berperingkat: sistem pertuturan-ke-teks menukar suara pemanggil kepada teks, model bahasa menghasilkan jawapan bertulis, kemudian teks-ke-pertuturan menyebutkannya. Pendekatan ini boleh berfungsi dengan baik, tetapi setiap peringkat ialah satu serahan. Aplikasi perlu menyelaras masa, jeda, perubahan niat dan gangguan pengguna merentasi beberapa komponen. 3
GPT-Live-1 diposisikan sebagai satu model suara yang memproses audio masuk dan audio keluar. Dalam penggunaan sebenar, reka bentuk full-duplex bermaksud ia boleh terus mendengar ketika sedang menjana pertuturan. Tujuannya ialah supaya model dapat memberi respons kepada gangguan atau pengakuan ringkas tanpa menganggap setiap bunyi, kesenyapan atau perbualan di latar sebagai giliran baharu yang mesti dijawab. 3
Jadi, kelebihannya bukan semata-mata suara yang dijana lebih pantas. Ia lebih kepada kawalan perbualan: mengenal pasti sama ada seseorang masih berfikir, sedang mencelah, atau hanya menyebut “ya” sebagai tanda masih mengikuti penerangan — bukannya meminta jawapan baharu. OpenAI menyifatkannya sebagai pilihan utamanya untuk perbualan suara yang semula jadi dan ekspresif, dengan pengendalian gangguan yang lancar. 2
3
GPT-Live-1 tidak semestinya perlu mengendalikan seluruh logik perniagaan sendiri. Ia boleh mengekalkan perbualan masa nyata sambil menyerahkan penaakulan yang lebih rumit, panggilan alatan atau tindakan kepada model backend dan rangka kerja ejen yang dipilih berasingan. 3
Bagi pembangun, pemisahan ini memberi beberapa pilihan praktikal:
Hasilnya ialah sistem dua bahagian: GPT-Live-1 mengurus interaksi suara secara langsung, sementara backend menyediakan penaakulan, data perniagaan dan tindakan. Namun, kadar harga suara yang diiklankan bukanlah kos penuh sebuah ejen. Inferens backend, alatan, telefoni dan perkhidmatan berkaitan boleh meningkatkan kos operasi. 3
5
Menurut OpenAI, pembangun boleh menetapkan nada, kelajuan dan gaya perbualan melalui system prompt. GPT-Live-1 juga menyediakan transkrip serta teks respons, menyokong pemahaman aksara alfanumerik dan keyword biasing, selain menawarkan pengesanan giliran untuk produk yang masih memerlukan sempadan giliran yang jelas. 3
Model ini disasarkan untuk sesi lebih panjang dan ejen berasaskan telefon, termasuk aliran kerja khidmat pelanggan serta tempahan. OpenAI menyatakan ia boleh mengendalikan kesenyapan dan bunyi latar tanpa menghuraikan setiap langkah dalaman, sesuatu yang berguna dalam panggilan telefon sebenar dan persekitaran yang kurang terkawal. 3
Dokumentasi yang dibekalkan tidak menetapkan senarai bahasa yang disokong secara muktamad atau kawalan pembangun terperinci bagi aksen dan dialek tertentu. Butiran pelaksanaan ini wajar disemak dalam dokumentasi API terkini sebelum dijadikan syarat penggunaan.
OpenAI melaporkan GPT-Live-1 mencatat peningkatan 30 mata peratusan berbanding GPT-Realtime-2.1 dalam Full Duplex Bench, iaitu penilaian terhadap tingkah laku suara interaktif seperti pengambilan giliran, jeda, gangguan, pengakuan ringkas dan pertuturan latar. 3
Apabila digandingkan dengan GPT-6 Astra pada tahap usaha penaakulan sederhana, OpenAI turut melaporkan GPT-Live-1 menduduki tempat pertama dalam Tau3, penanda aras ejen suara hujung ke hujung. Komponen khidmat pelanggannya meliputi tugasan pertuturan dalam sektor penerbangan, peruncitan dan telekomunikasi. 3
Sesetengah laporan sekunder menyatakan angka khusus untuk kependaman pengambilan giliran dan skor Tau3. Namun, bahan sumber utama yang dibekalkan di sini tidak menyediakan angka tepat tersebut. Kesimpulan yang lebih wajar ialah OpenAI melaporkan peningkatan besar dalam tingkah laku interaktif dan keputusan teratas Tau3 bagi konfigurasi GPT-Live-1 bersama Astra — bukannya setiap pelaksanaan akan menghasilkan nombor penanda aras yang sama. 3
7
OpenAI menonjolkan beberapa penggunaan awal ejen suara ini:
Contoh ini menunjukkan keadaan yang paling sesuai untuk full-duplex: apabila pemanggil mungkin teragak-agak, membetulkan kata-kata sendiri, memberi pengakuan ketika ejen masih bercakap, atau mencelah tanpa mahu memulakan semula keseluruhan interaksi.
Kadar GPT-Live-1 ialah AS$0.05 seminit untuk lapisan suara bahagian hadapan. Pembangun boleh menggandingkannya dengan model backend dan rangka kerja ejen pilihan sendiri, tetapi pilihan itu mempengaruhi jumlah kos kerana ia dibilkan secara berasingan daripada lapisan suara. 3
5
OpenAI turut menyebut OpenAI Presence sebagai satu lagi cara untuk membina aliran kerja suara menggunakan GPT-Live-1 bagi interaksi suara masa nyata. Namun, bahan yang dibekalkan tidak menerangkan kelayakan perusahaan, terma komersial, model pengehosan atau proses akses bagi Presence. Oleh itu, perkara tersebut tidak wajar diandaikan hanya berdasarkan pengumuman API. 3
Bagi pasukan yang menilai model ini, soalan utama bukan sekadar kadar seminit: sejauh mana nilai pengambilan giliran yang lebih lancar kepada aliran kerja mereka, serta model backend dan laluan alatan manakah yang boleh memberi kebolehpercayaan diperlukan pada jumlah kos yang munasabah?
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
GPT Live 1 tersedia dalam API sejak 10 September 2026 pada harga AS$0.05 seminit bagi lapisan suara bahagian hadapan.
GPT Live 1 tersedia dalam API sejak 10 September 2026 pada harga AS$0.05 seminit bagi lapisan suara bahagian hadapan. Reka bentuk full duplex membolehkannya terus mendengar ketika bertutur, supaya gangguan, jeda dan respons ringkas dapat dikendalikan dengan lebih semula jadi.
OpenAI melaporkan peningkatan 30 mata peratusan berbanding GPT Realtime 2.1 dalam Full Duplex Bench, serta kedudukan pertama Tau3 apabila digandingkan dengan GPT 6 Astra.