GPT Bidi 1 adalah model suara dwiarah (bidirectional) baharu oleh OpenAI yang membolehkan ChatGPT mendengar dan bercakap pada masa yang sama. Model ini mengendalikan gangguan (interruption) di tengah tengah ayat tanpa membeku atau terputus, menjadikan perbualan lebih semula jadi.
Research answer

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is OpenAI's GPT-Bidi-1 bidirectional voice model for ChatGPT, including how it was discovere. Article summary: OpenAI's **GPT-Bidi-1** is a next-generation bidirectional voice model for ChatGPT, discovered via code and UI references in the ChatGPT web and mobile apps. It represents the largest voice-mode upgrade ever for ChatGPT,. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
OpenAI sedang bersiap sedia untuk meningkatkan lagi keupayaan suara ChatGPT dengan model audio dwiarah (bidirectional) yang dikenali sebagai GPT-Bidi-1. Berbeza dengan mod suara ChatGPT sebelum ini yang menunggu pengguna selesai bercakap sebelum memberi respons, GPT-Bidi-1 mampu mendengar dan bercakap serentak — ia boleh menyerap gangguan, membetulkan kesilapan dalam masa nyata, dan melaraskan jawapan tanpa memutuskan aliran audio.
Artikel ini akan membincangkan bagaimana GPT-Bidi-1 ditemui, apa yang membezakannya dengan model suara giliran (turn-based), tiga tahap kecerdasan yang diperkenalkan, perubahan visual pada antara muka ChatGPT, dan konteks persaingan pembangunannya. Model ini masih belum diumumkan secara rasmi oleh OpenAI, jadi segala butiran adalah berdasarkan penemuan kod, rujukan antara muka, laporan pengguna, dan analisis media.
Rantaian penemuan bermula dengan pembangun M1Astra, yang mula-mula mengesan rujukan kepada gpt-bidi-1 dalam kod aplikasi ChatGPT dan berkongsi penemuan tersebut di X (dahulunya Twitter). Laman penjejak TestingCatalog kemudiannya mengesahkan rentetan model tersebut, bersama dengan teks pengumuman yang menggambarkannya sebagai "generasi suara seterusnya" dan "lonjakan besar dalam kecerdasan."
Elemen kod dan antara muka pengguna (UI) kemudian ditemui pada kedua-dua klien ChatGPT web dan mudah alih. Ujian terhad mula diedarkan kepada sekumpulan kecil pengguna pada akhir Jun 2026. Menjelang 22–24 Jun 2026, pelbagai laporan pengguna dan video demonstrasi muncul menunjukkan model tersebut berfungsi secara dwiarah.
Perhatian: OpenAI masih belum mengeluarkan sebarang pengumuman rasmi. Nama akhir model, tingkah laku tahap yang tepat, dan tarikh pelancaran masih belum disahkan oleh syarikat.
Mod suara ChatGPT semasa — Suara Standard (Standard Voice) dan Mod Suara Lanjutan (Advanced Voice Mode) — beroperasi dalam paradigma giliran (turn-based). Model mesti menunggu pengguna selesai bercakap sebelum ia boleh memberi respons. Seni bina dwiarah (BiDi) GPT-Bidi-1 membolehkan model memproses dua aliran audio serentak: suara anda dan suaranya sendiri.
Perbezaan tingkah laku utama yang dilaporkan dalam demonstrasi:
Matlamat dalaman OpenAI adalah untuk merapatkan jurang antara timbunan suara ChatGPT — yang ketinggalan di belakang model teksnya (sudah berada pada tahap pemikiran kelas GPT-5.5) — dan menyampaikan pariti dalam kecerdasan perbualan masa nyata.
GPT-Bidi-1 adalah model suara OpenAI yang pertama memperkenalkan tiga tahap kecerdasan dan kelajuan untuk suara:
| Tahap | Penerangan |
|---|---|
| High (Tinggi) | Kedalaman penaakulan maksimum, respons lebih perlahan — untuk tugasan analisis kompleks |
| Medium (Sederhana) | Keseimbangan antara kecerdasan dan kelajuan |
| Instant (Segera) | Respons terpantas, penaakulan berkurangan — untuk interaksi kasual atau sensitif masa |
Sistem tahap ini membolehkan pengguna menyesuaikan kedalaman interaksi berbanding kependaman (latency) mengikut tugasan, sama seperti model teks ChatGPT yang menawarkan tahap penaakulan berbeza. Contohnya, pertanyaan cuaca ringkas akan menggunakan mod Instant, manakala sesi sumbangsaran mendalam akan bertukar ke mod High.
Apabila GPT-Bidi-1 dipilih, gelembung suara/penunjuk gelombang bertukar menjadi kuning dan bukannya warna lalai semasa. Model ini muncul dalam pemilih model (model-selector) tetapan sebagai pilihan baharu berlabel "Bidi (Terkini)" bersama-sama dengan Suara Standard dan Mod Suara Lanjutan yang sedia ada, bukannya menggantikannya.
gpt-bidi-1. Konteks Persaingan: Dorongan suara dwiarah ini secara langsung menjawab kemajuan daripada Google (Gemini Live dengan gangguan), Anthropic, dan ejen suara masa nyata daripada syarikat pemula. OpenAI sedang berlumba untuk membawa pariti interaksi suara kepada kecerdasan teksnya, yang sudah pun menguasai penaakulan tahap GPT-5.5.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
GPT Bidi 1 adalah model suara dwiarah (bidirectional) baharu oleh OpenAI yang membolehkan ChatGPT mendengar dan bercakap pada masa yang sama.
GPT Bidi 1 adalah model suara dwiarah (bidirectional) baharu oleh OpenAI yang membolehkan ChatGPT mendengar dan bercakap pada masa yang sama. Model ini mengendalikan gangguan (interruption) di tengah tengah ayat tanpa membeku atau terputus, menjadikan perbualan lebih semula jadi.
Pengenalan tiga tahap kecerdasan suara: High (mendalam & perlahan), Medium (seimbang), dan Instant (pantas untuk tugasan ringkas).