GPT-Live to nowa rodzina modeli głosowych zbudowana w oparciu o architekturę pełnego dupleksu – może słuchać i mówić jednocześnie, zamiast naprzemiennie w trybie „naciśnij i mów” . 8 lipca 2026 r. wydano dwie wersje:
System ten całkowicie zastępuje dotychczasowy Advanced Voice Mode . Kluczowe zmiany architektoniczne:
Dotychczasowy Advanced Voice Mode (uruchomiony w połowie 2024 r.) był systemem naprzemiennym – na zmianę słuchał i mówił. Został całkowicie zastąpiony przez GPT-Live 8 lipca 2026 r. . Starsza funkcja głosowa na macOS została wycofana jeszcze wcześniej – 15 stycznia 2026 r. – w ramach szerszego planu usprawnienia możliwości głosowych przed premierą GPT-Live
.
ChatGPT Voice na desktopie umożliwia głosowe sterowanie całą ujednoliconą aplikacją w trzech trybach – Chat, Work i Codex – wszystkie dostępne z jednej powłoki .
Użytkownicy mogą wydawać polecenia głosowe, aby kierować wieloma agentami działającymi jednocześnie w Work lub Codex, np. „Sprawdź mój kalendarz, napisz e-mail i przygotuj podsumowanie spotkania” .
W aplikacji na Maca ChatGPT Voice integruje się z Appshots – funkcją pierwotnie wydaną dla Codex w maju 2026 r., która pozwala AI przechwycić aktywne okno aplikacji – wraz z jego zrzutem ekranu i dostępnym tekstem – w celu uzyskania kontekstu .
ChatGPT Voice na desktopie wykorzystuje Computer Use (możliwość OpenAI do sterowania systemem operacyjnym), lokalne pliki i wtyczki do wykonywania poleceń głosowych . System może:
Premiera ChatGPT Voice na desktopie jest zwieńczeniem dużej konsolidacji produktów, która miała miejsce dwa tygodnie wcześniej, 9 lipca 2026 r.: