GPT-Liveは、フルデュプレックス(全二重)アーキテクチャを採用した新世代の音声モデルファミリーです。従来の「プッシュ・トゥ・トーク」方式のように交互に聞く・話すのではなく、聞きながら同時に話すことができます 。
2026年7月8日、以下の2バージョンがリリースされました:
なお、2024年半ばにローンチされた旧Advanced Voice Modeはターンベース方式でしたが、2026年7月8日をもってGPT-Liveに完全に置き換えられました 。macOS版の旧音声機能はさらに早く、2026年1月15日に廃止されています
。
Mac版デスクトップアプリでは、ChatGPT VoiceがAppshots機能と統合されています。この機能は2026年5月にCodex向けに先行リリースされたもので、AIが最前面のアプリウィンドウのスクリーンショットとアクセス可能なテキストを文脈として取得できるようにするものです 。
ChatGPT Voice on Desktopは、Computer Use(OpenAIのOS制御機能)、ローカルファイル、プラグインを活用して音声リクエストを実行します 。システムは以下の操作を行えます:
ChatGPT Voiceのデスクトップ展開は、**2週間前(2026年7月9日)**に行われた大規模な製品統合の上に成り立っています: