GPT-Live คือตระกูลโมเดลเสียงรุ่นใหม่ที่สร้างบน สถาปัตยกรรมแบบฟูลดูเพล็กซ์ — สามารถฟังและพูดไปพร้อมกันได้ ไม่ใช่สลับกันแบบ "กดเพื่อพูด" มีสองเวอร์ชันที่เปิดตัวเมื่อวันที่ 8 กรกฎาคม 2026:
ระบบนี้ เข้ามาแทนที่ Advanced Voice Mode รุ่นเก่าทั้งหมด การเปลี่ยนแปลงทางสถาปัตยกรรมที่สำคัญคือ:
Advanced Voice Mode รุ่นเก่า (ที่เปิดตัวกลางปี 2024) เป็นระบบแบบผลัดกันฟังและพูด มัน ถูกแทนที่อย่างสมบูรณ์ โดย GPT-Live เมื่อวันที่ 8 กรกฎาคม 2026 ฟีเจอร์เสียงบนเดสก์ท็อป macOS รุ่นเก่าถูกยกเลิกไปก่อนหน้านั้น — ในวันที่ 15 มกราคม 2026 — ซึ่งเป็นส่วนหนึ่งของแผนการปรับปรุงความสามารถด้านเสียงให้ดียิ่งขึ้นก่อนการเปิดตัว GPT-Live
ChatGPT Voice บนเดสก์ท็อปช่วยให้ผู้ใช้ ควบคุมแอปครบวงจรด้วยเสียง ในสามโหมด — Chat, Work และ Codex — ทั้งหมดสามารถเข้าถึงได้จากเชลล์เดสก์ท็อปเดียว
ผู้ใช้สามารถพูดคำสั่งเพื่อ สั่งงานเอเจนต์หลายตัว ที่ทำงานใน Work หรือ Codex พร้อมกันได้ เช่น "เช็กปฏิทินของฉัน ร่างอีเมล และเตรียมสรุปการประชุม"
บน แอปเดสก์ท็อป Mac ChatGPT Voice ผสานรวมกับ Appshots ฟีเจอร์ที่เปิดตัวครั้งแรกสำหรับ Codex ในเดือนพฤษภาคม 2026 ซึ่งช่วยให้ AI จับภาพ หน้าต่างแอปด้านหน้าที่สุด — รวมถึงภาพหน้าจอและข้อความที่เข้าถึงได้ — เพื่อใช้เป็นบริบท
ChatGPT Voice บนเดสก์ท็อปใช้ประโยชน์จาก Computer Use (ความสามารถของ OpenAI ในการควบคุมระบบปฏิบัติการ), ไฟล์ในเครื่อง และปลั๊กอินเพื่อดำเนินการตามคำขอด้วยเสียง ระบบสามารถ:
การเปิดตัว ChatGPT Voice บนเดสก์ท็อปนั้นขึ้นอยู่กับการรวมผลิตภัณฑ์ครั้งใหญ่ที่เกิดขึ้น เมื่อสองสัปดาห์ก่อน ในวันที่ 9 กรกฎาคม 2026:
| ก่อนวันที่ 9 กรกฎาคม | หลังวันที่ 9 กรกฎาคม |
|---|---|
| แอปเดสก์ท็อป Codex แบบสแตนด์อโลน | Codex ถูกรวมเข้ากับแอปเดสก์ท็อป ChatGPT แบบครบวงจร |
| แอป ChatGPT และ Codex แยกกัน | แอปเดียวที่มีแท็บโหมด **Chat |
| ไม่มีเอเจนต์ ChatGPT Work | ChatGPT Work ถูกเพิ่มเป็นเอเจนต์ใหม่สำหรับงานที่ไม่ใช่การเขียนโค้ด |
| GPT-5.5 สำหรับงานที่ซับซ้อน | GPT-5.6 (ตระกูลโมเดล Sol / Terra / Luna) ขับเคลื่อนประสบการณ์แบบครบวงจร |