GPT-Live è una nuova famiglia di modelli vocali basati su un'architettura full-duplex: ascolta e parla contemporaneamente, invece di alternarsi in uno stile "push-to-talk" . Due versioni sono state rilasciate l'8 luglio 2026:
Questo sistema sostituisce completamente la precedente Advanced Voice Mode . Le novità architetturali principali sono:
La precedente Advanced Voice Mode (lanciata a metà 2024) era un sistema a turni che alternava ascolto e parlato. È stata completamente sostituita da GPT-Live l'8 luglio 2026 . La vecchia funzionalità vocale del desktop macOS era stata ritirata ancora prima, il 15 gennaio 2026, come parte di un piano più ampio per snellire e potenziare le capacità vocali in vista del lancio di GPT-Live
.
ChatGPT Voice sul desktop consente di controllare l'intera app unificata con la voce attraverso tre modalità — Chat, Work e Codex — tutte accessibili da un unico guscio desktop .
Gli utenti possono impartire comandi vocali per dirigere più agenti in esecuzione in Work o Codex contemporaneamente, ad esempio: "Controlla il mio calendario, scrivi una bozza di email e prepara un riepilogo per la riunione" .
Nell'app desktop per Mac, ChatGPT Voice si integra con Appshots, una funzione originariamente rilasciata per Codex a maggio 2026 che consente all'AI di catturare la finestra dell'app frontale — inclusi screenshot e testo accessibile — per ottenere contesto .
ChatGPT Voice sul desktop sfrutta Computer Use (la capacità di OpenAI di controllare il sistema operativo), file locali e plugin per eseguire richieste vocali . Il sistema può:
Il lancio di ChatGPT Voice sul desktop si basa su una grande riorganizzazione dei prodotti avvenuta due settimane prima, il 9 luglio 2026: