GPT-Live ialah keluarga model suara baharu yang dibina di atas seni bina sepenuh-dupleks — ia boleh mendengar dan bercakap serentak, berbanding berselang-seli dalam gaya "tekan untuk bercakap" . Dua versi telah dilancarkan pada 8 Julai 2026:
Sistem ini menggantikan sepenuhnya Advanced Voice Mode yang sebelumnya . Perubahan seni bina utama adalah:
Advanced Voice Mode yang sebelumnya (dilancarkan pada pertengahan 2024) adalah sistem berasaskan giliran yang berselang-seli antara mendengar dan bercakap. Ia diganti sepenuhnya oleh GPT-Live pada 8 Julai 2026 . Ciri suara desktop macOS lama telah pun ditamatkan lebih awal — pada 15 Januari 2026 — sebagai sebahagian daripada rancangan yang lebih luas untuk menyelaraskan dan meningkatkan keupayaan suara menjelang pelancaran GPT-Live
.
ChatGPT Voice pada desktop membolehkan pengguna mengawal seluruh aplikasi bersatu dengan suara merentasi tiga mod — Chat, Work, dan Codex — semuanya boleh diakses dari satu antara muka desktop .
Pengguna boleh memberi arahan suara untuk mengarahkan pelbagai agen yang berjalan dalam Work atau Codex secara serentak, contohnya: "Semak kalendar saya, sediakan draf e-mel, dan sediakan ringkasan mesyuarat" .
Pada aplikasi desktop Mac, ChatGPT Voice disepadukan dengan Appshots, ciri yang pada asalnya dikeluarkan untuk Codex pada Mei 2026 yang membolehkan AI menangkap tetingkap aplikasi hadapan — termasuk screenshot dan teks boleh akses — untuk konteks .
ChatGPT Voice pada desktop memanfaatkan Computer Use (keupayaan OpenAI untuk mengawal OS), fail tempatan, dan plugins untuk melaksanakan permintaan suara . Sistem ini boleh:
Pelancaran desktop ChatGPT Voice berada di atas penyatuan produk besar yang berlaku dua minggu lebih awal, pada 9 Julai 2026: