GPT-Live adalah keluarga baru model suara yang dibangun di atas arsitektur full-duplex — ia dapat mendengarkan dan berbicara secara bersamaan, tidak lagi bergantian dalam model 'tekan-untuk-berbicara' (push-to-talk) . Dua versi telah dirilis pada 8 Juli 2026:
Sistem ini sepenuhnya menggantikan Advanced Voice Mode sebelumnya . Perubahan arsitektur utama meliputi:
Advanced Voice Mode sebelumnya (diluncurkan pertengahan 2024) adalah sistem bergiliran. Sistem ini sepenuhnya digantikan oleh GPT-Live pada 8 Juli 2026 . Fitur suara lama di desktop macOS bahkan sudah lebih dulu dipensiunkan pada 15 Januari 2026 sebagai bagian dari rencana yang lebih luas untuk menyederhanakan dan meningkatkan kemampuan suara menjelang peluncuran GPT-Live
.
ChatGPT Voice di desktop memungkinkan pengguna mengendalikan seluruh aplikasi terpadu dengan suara di tiga mode — Chat, Work, dan Codex — semuanya dapat diakses dari satu jendela desktop .
Pengguna dapat memberikan perintah suara untuk mengarahkan banyak agen yang berjalan di Work atau Codex secara bersamaan, misalnya: "Cek kalender saya, buat draf email, dan siapkan ringkasan rapat" .
Di aplikasi desktop Mac, ChatGPT Voice terintegrasi dengan Appshots, sebuah fitur yang awalnya dirilis untuk Codex pada Mei 2026 yang memungkinkan AI menangkap jendela aplikasi terdepan — termasuk tangkapan layar dan teks yang dapat diakses — untuk dijadikan konteks .
ChatGPT Voice di desktop memanfaatkan Computer Use (kemampuan OpenAI untuk mengendalikan OS), file lokal, dan plugin untuk menjalankan perintah suara . Sistem ini dapat:
Peluncuran ChatGPT Voice di desktop berada di atas konsolidasi produk besar yang terjadi dua minggu sebelumnya, pada 9 Juli 2026: