GPT-Live คือตระกูลโมเดลเสียงรุ่นใหม่ที่สร้างบน สถาปัตยกรรมแบบฟูลดูเพล็กซ์ — สามารถฟังและพูดไปพร้อมกันได้ ไม่ใช่สลับกันแบบ "กดเพื่อพูด" มีสองเวอร์ชันที่เปิดตัวเมื่อวันที่ 8 กรกฎาคม 2026:
Advanced Voice Mode รุ่นเก่า (ที่เปิดตัวกลางปี 2024) เป็นระบบแบบผลัดกันฟังและพูด มัน ถูกแทนที่อย่างสมบูรณ์ โดย GPT-Live เมื่อวันที่ 8 กรกฎาคม 2026 ฟีเจอร์เสียงบนเดสก์ท็อป macOS รุ่นเก่าถูกยกเลิกไปก่อนหน้านั้น — ในวันที่ 15 มกราคม 2026 — ซึ่งเป็นส่วนหนึ่งของแผนการปรับปรุงความสามารถด้านเสียงให้ดียิ่งขึ้นก่อนการเปิดตัว GPT-Live
ChatGPT Voice บนเดสก์ท็อปช่วยให้ผู้ใช้ ควบคุมแอปครบวงจรด้วยเสียง ในสามโหมด — Chat, Work และ Codex — ทั้งหมดสามารถเข้าถึงได้จากเชลล์เดสก์ท็อปเดียว
ผู้ใช้สามารถพูดคำสั่งเพื่อ สั่งงานเอเจนต์หลายตัว ที่ทำงานใน Work หรือ Codex พร้อมกันได้ เช่น "เช็กปฏิทินของฉัน ร่างอีเมล และเตรียมสรุปการประชุม"
บน แอปเดสก์ท็อป Mac ChatGPT Voice ผสานรวมกับ Appshots ฟีเจอร์ที่เปิดตัวครั้งแรกสำหรับ Codex ในเดือนพฤษภาคม 2026 ซึ่งช่วยให้ AI จับภาพ หน้าต่างแอปด้านหน้าที่สุด — รวมถึงภาพหน้าจอและข้อความที่เข้าถึงได้ — เพื่อใช้เป็นบริบท
ChatGPT Voice บนเดสก์ท็อปใช้ประโยชน์จาก Computer Use (ความสามารถของ OpenAI ในการควบคุมระบบปฏิบัติการ), ไฟล์ในเครื่อง และปลั๊กอินเพื่อดำเนินการตามคำขอด้วยเสียง ระบบสามารถ:
การเปิดตัว ChatGPT Voice บนเดสก์ท็อปนั้นขึ้นอยู่กับการรวมผลิตภัณฑ์ครั้งใหญ่ที่เกิดขึ้น เมื่อสองสัปดาห์ก่อน ในวันที่ 9 กรกฎาคม 2026: