Begge erstatter den tidligere ChatGPT Advanced Voice Mode. De er bygget på en ægte fuld-duplex arkitektur, der løbende behandler indkommende lyd, mens den genererer talte svar – i modsætning til den gamle halv-duplex tilgang, hvor modellen skulle være færdig med at tale, før den kunne høre brugeren HAT.
OpenAI oplyser, at inferensomkostningerne er faldet nok til at få økonomien i stemmeassistenter til at fungere, hvilket er grunden til, at modellen også er tilgængelig for gratisbrugere A. Ved lanceringen bruger GPT-Live GPT-5.5 i baggrunden til at ræsonnere OH.
Fuld-duplex kapaciteten ændrer følelsen af stemme-AI på tre helt konkrete måder, som OpenAI demonstrerede under sin lanceringsbriefing.
Modellen kan afbrydes midt i en sætning og vil stoppe og lytte i stedet for at tale hen over brugeren. Den opdager også, når en bruger tænker sig om midt i en sætning, og venter i stedet for at afbryde AT. OpenAIs produktchef Atty Eleti sagde under briefingen: "Det her er en fuld-duplex model" T.
Modellen kan også vise, at den lytter med ved at sige 'mmh' eller 'ja' mens brugeren stadig taler, og den holder sig stille, når du har brug for et øjeblik til at tænke OB.
Når GPT-Live støder på et svært spørgsmål, delegerer den ræsonnementet til OpenAIs nyeste tekstmodeller (som GPT-5.5) parallelt, mens GPT-Live selv bliver i samtalen med brugeren AT. Forskningsleder Kundan Kumar forklarede: "Når GPT-Live skal tænke sig om for at besvare et spørgsmål, kan den delegere ræsonnement og komplekse opgaver til GPT-5.5 parallelt, mens GPT-Live stadig er i samtale med brugeren" LT. Det betyder, at brugerne ikke venter på, at stemmemodellen skal tænke sig om – overgangen fra research til talte resultater sker næsten øjeblikkeligt T.
GPT-Live kan supplere diskussioner med visuelle elementer på skærmen – billeder, diagrammer eller andet AI-genereret indhold – hvilket skaber en multimodal oplevelse, der går ud over ren stemmechat HAT. The Verge rapporterede, at modellen vil supplere samtaler om vejr, aktier og sport med AI-genererede billeder T.
Samlet set gør disse funktioner samtalerne tættere på naturlig menneskelig dialog. Business Insider beskrev assistenten som en, der "vil have dig til at tale hen over den" B. The Verges overskrift lød, at den er "bedre til at tie stille" T.
De to nøglepersoner, der er nævnt i pressebriefinger og medierapporter, er:
Tidligere rapporter fra januar 2026 nævnte også infrastrukturchef Ben Newhouse og produktchef Jackie Shannon som involveret i omstruktureringen af lyd-AI IX.
gpt-realtime-2.1 og gpt-realtime-2.1-mini) med 25 % lavere p95-latens gennem forbedret caching C.En begrænsning, der blev noteret ved lanceringen: GPT-Live understøtter ikke stemme med videofunktioner T.
OpenAI lancerede GPT-Live midt i en usædvanlig travl uge på tværs af AI-industrien.
OpenAIs eget bredere økosystem:
Konkurrenter og relaterede nyheder: