Beide vervangen de vorige ChatGPT Advanced Voice Mode. Ze zijn gebouwd op een echte full-duplex architectuur die continu inkomende audio verwerkt terwijl ze gesproken antwoorden genereren, in plaats van de oude half-duplex aanpak waarbij het model klaar moest zijn met praten voordat het de gebruiker kon horen HAT.
OpenAI gaf aan dat de rekenkosten voldoende zijn gedaald om de economie van spraak werkbaar te maken, daarom is het model ook beschikbaar voor gratis gebruikers A. Bij de lancering gebruikt GPT-Live GPT-5.5 op de achtergrond voor redeneringen OH.
Full-duplex mogelijkheden veranderen het gevoel van spraak-AI op drie specifieke manieren, die OpenAI tijdens de lancering demonstreerde.
Het model kan halverwege een zin worden onderbroken en stopt dan met praten om te luisteren, in plaats van door de gebruiker heen te praten. Het detecteert ook wanneer een gebruiker midden in een gedachte pauzeert en wacht dan in plaats van in te vallen AT. OpenAI productleider Atty Eleti zei tijdens de briefing: "Dit is een full-duplex model" T.
Het model kan ook laten zien dat het oplet met zinnetjes als "mhmm" of "ja" terwijl de gebruiker nog aan het woord is, en blijft stil wanneer je even moet nadenken OB.
Wanneer GPT-Live een moeilijke vraag tegenkomt, delegeert het redeneringen naar OpenAI's nieuwste tekstmodellen (zoals GPT-5.5) in parallel, terwijl GPT-Live zelf in gesprek blijft met de gebruiker AT. Onderzoeksleider Kundan Kumar legde uit: "Wanneer GPT-Live hard moet nadenken over een vraag, kan het zijn redenering en complexe taak delegeren aan GPT-5.5 in parallel, terwijl GPT-Live nog steeds in gesprek blijft met de gebruiker" LT. Dit betekent dat gebruikers niet hoeven te wachten tot het spraakmodel zware taken heeft doordacht — de overgang van onderzoek naar gesproken bevindingen is bijna onmiddellijk T.
GPT-Live kan discussies aanvullen met beelden op het scherm — afbeeldingen, diagrammen of andere AI-gegenereerde content — wat zorgt voor een multimodale ervaring die verder gaat dan pure spraakchat HAT. The Verge meldde dat het model gesprekken over het weer, aandelen en sport zal aanvullen met AI-gegenereerde afbeeldingen T.
Alles bij elkaar maken deze functies gesprekken die dichter bij natuurlijke menselijke dialogen staan. Business Insider omschreef het als een assistent die "wil dat je erdoorheen praat" B. The Verge kopte dat het "beter is in zijn mond houden" T.
De twee belangrijkste personen die in persconferenties en mediaberichten worden genoemd, zijn:
Eerdere rapporten uit januari 2026 noemden ook infrastructuurleider Ben Newhouse en productmanager Jackie Shannon als betrokken bij de herstructurering van audio-AI IX.
gpt-realtime-2.1 en gpt-realtime-2.1-mini) met 25% lagere p95-latentie door verbeterde caching C.Een beperking die bij de lancering werd opgemerkt: GPT-Live ondersteunt momenteel geen spraak met videomogelijkheden T.
OpenAI lanceerde GPT-Live midden in een uitzonderlijk drukke week in de AI-industrie.
OpenAI's eigen bredere ecosysteem:
Concurrenten en aanverwant nieuws: