OpenAI GPT-Live-1: Helt ny röstassistent som avbryter, skickar vidare till GPT-5.5 och genererar bilder mitt i samtalet
OpenAI lanserade GPT Live 1 (betald) och GPT Live 1 mini (gratis) globalt den 8 juli 2026. Röstmodellerna kan avbrytas mitt i en mening, känna av när användaren pausar och vänta, samt visa AI genererade bilder under samtalets gång.
OpenAI lanserade GPT Live 1 (betald) och GPT Live 1 mini (gratis) globalt den 8 juli 2026.
Röstmodellerna kan avbrytas mitt i en mening, känna av när användaren pausar och vänta, samt visa AI genererade bilder under samtalets gång.
GPT Live använder GPT 5.5 i bakgrunden för komplexa resonemang, och samtalet flyter på utan fördröjning.
Utvecklingen leds av forskningschefen Kundan Kumar (tidigare Character.AI) och produktchefen Atty Eleti.
Search & fact-check with cited sources for What is OpenAI's new GPT-Live-1 and GPT-Live-1 mini, how do their full-duplex voice capabilitiesAI-generated hero image for OpenAI's GPT-Live-1 and GPT-Live-1 mini voice models.
AI Prompt
Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is OpenAI's new GPT-Live-1 and GPT-Live-1 mini, how do their full-duplex voice capabilities. Article summary: Here is the complete fact-checked rundown.. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
openai.com
Den 8 juli 2026 lanserade OpenAI GPT-Live, en helt ny familj av röstmodeller som innebär ett fundamentalt skifte i hur vi interagerar med AI-assistenter ROA. Istället för den stela "jag pratar, sedan du pratar"-modellen som tidigare röstassistenter använt, bygger GPT-Live-1 och GPT-Live-1 mini på en full-duplex-arkitektur som kan lyssna och prata samtidigt HA. Lanseringen sker globalt och rullas ut till alla ChatGPT-användare från och med idag.
Studio Global AI
Continue your research
This page includes a source-backed answer you can continue inside Studio Global.
What is the short answer to "OpenAI GPT-Live-1: Helt ny röstassistent som avbryter, skickar vidare till GPT-5.5 och genererar bilder mitt i samtalet"?
OpenAI lanserade GPT Live 1 (betald) och GPT Live 1 mini (gratis) globalt den 8 juli 2026.
What are the key points to validate first?
OpenAI lanserade GPT Live 1 (betald) och GPT Live 1 mini (gratis) globalt den 8 juli 2026. Röstmodellerna kan avbrytas mitt i en mening, känna av när användaren pausar och vänta, samt visa AI genererade bilder under samtalets gång.
What should I do next in practice?
GPT Live använder GPT 5.5 i bakgrunden för komplexa resonemang, och samtalet flyter på utan fördröjning.
Här är en faktagranskad genomgång av vad modellerna gör, hur de skiljer sig från äldre röstassistenter, vem som utvecklat dem och vad mer som hände inom AI samma vecka.
GPT-Live-1 – rullas ut till betalda ChatGPT-nivåer (Go, Plus, Pro)
GPT-Live-1 mini – rullas ut till gratisanvändare
Båda ersätter den tidigare ChatGPT Advanced Voice Mode. De är byggda på en äkta full-duplex-arkitektur som kontinuerligt bearbetar inkommande ljud samtidigt som den genererar talade svar HAT. OpenAI uppger att beräkningskostnaderna har sjunkit tillräckligt mycket för att göra röstens ekonomi hållbar, vilket är anledningen till att modellen även finns tillgänglig för gratisanvändare A. Vid lanseringen använder GPT-Live GPT-5.5 i bakgrunden för resonemang OH.
Hur full-duplex-röst förbättrar äldre röstassistenter
Full-duplex-förmågan förändrar känslan av röst-AI på tre specifika sätt som OpenAI demonstrerade under sin lanseringspresentation.
1. Naturliga avbrott och turtagning
Modellen kan avbrytas mitt i en mening och kommer då att stanna upp och lyssna, istället för att prata över användaren. Den känner också av när användaren pausar i sin tankegång och väntar istället för att hugga in AT. OpenAIs produktchef Atty Eleti sa under presentationen: "Det här är en full-duplex-modell" T.
Modellen kan också visa att den lyssnar genom att säga "mhmm" eller "ja" medan användaren fortfarande pratar, och den håller tyst när du behöver en stund att tänka OB.
2. Vidarebefordran av komplexa frågor till toppmoderna textmodeller parallellt
När GPT-Live ställs inför en svår fråga delegerar den resonemanget till OpenAIs senaste textmodeller (som GPT-5.5) parallellt, medan GPT-Live själv fortsätter samtalet med användaren AT. Forskningschef Kundan Kumar förklarade: "När GPT-Live måste tänka hårt för en fråga kan den delegera sitt resonemang och komplexa uppgifter till GPT-5.5 parallellt, medan GPT-Live fortfarande är i samtal med användaren" LT. Detta innebär att användare inte behöver vänta på att röstmodellen ska resonera sig igenom tunga uppgifter – övergången från forskning till talade resultat sker nästan omedelbart T.
3. AI-genererade bilder under samtalet
GPT-Live kan komplettera diskussioner med visuellt innehåll på skärmen – bilder, diagram eller annat AI-genererat material – vilket skapar en multimodalt upplevelse som går utöver ren röstchatt HAT. The Verge rapporterade att modellen kommer att komplettera samtal om väder, aktier och sport med AI-genererade bilder T.
Sammantaget gör dessa funktioner att samtalen känns mer som naturlig mänsklig dialog. Business Insider beskrev det som en assistent som "vill att du ska prata över den" B. The Verge konstaterade att den är "bättre på att hålla tyst" T.
Vem ledde utvecklingen?
De två nyckelpersonerna som nämns i pressgenomgångar och medierapporter är:
Kundan Kumar – Forskningschef för GPT-Live, beskriven av The Verge som "OpenAI-forskare och ledare" för projektet LT. Han anslöt till OpenAI från Character.AI i mitten av 2025 och fungerade som central ledare för ljud-AI-projektet IIC.
Atty Eleti – Produktchef för ChatGPT Voice, som presenterade modellen under lanseringssändningen AT.
Tidigare rapporter från januari 2026 nämner också infrastrukturchefen Ben Newhouse och produktchefen Jackie Shannon som involverade i omstruktureringen av ljud-AI IX.
Lanseringsschema
8 juli 2026 – Global lansering som började rullas ut till alla ChatGPT-användare på iOS, Android och webben, med GPT-Live-1 för betalda prenumeranter och GPT-Live-1 mini för gratisanvändare RHT.
Samtidigt den 7–8 juli släppte OpenAI nya API Realtime-modeller (gpt-realtime-2.1 och gpt-realtime-2.1-mini) med 25 % lägre p95-latens genom förbättrad cachning C.
En begränsning som noterades vid lanseringen: GPT-Live stöder för närvarande inte röst med videofunktioner T.
Andra stora AI-lanseringar samma vecka
OpenAI lanserade GPT-Live mitt i en ovanligt hektisk vecka inom AI-branschen.
OpenAIs eget bredare ekosystem:
GPT-5.6 (Sol, Terra och Luna-varianter) förväntades släppas offentligt den 9 juli 2026, vilket breddade tillgången efter en tidigare begränsad lansering HE.
Konkurrenter och relaterade nyheter:
Anthropic – Skickade ut en betydande uppdatering av Claude Sonnet 5 i början av juli, med förbättrad instruktionsföljning och kodgenereringsnoggrannhet för komplexa agentiska uppgifter S. Trump-administrationen hävde också exportkontrollerna på Anthropics modeller Fable 5 och Mythos 5 samma vecka SLF.
Google DeepMind – Lansrade NanoBanana 2 Lite, en bildgenereringsmodell som producerar bilder på under 4 sekunder till en kostnad av $0,034 per 1 000 bilder T.
Meta – Rapporterades förbereda sig för att erbjuda neocloud-tjänster, och var separat under press från den amerikanska regeringen om AI-säkerhetsgranskningar NL.
SpaceXAI (xAI) – Förberedde sig enligt uppgift för att släppa nya AI-modeller i samarbete med Anysphere (Cursor) som en del av en bredare konkurrenssatsning E.
Kina – En 9-dagars nedräkning inleddes till Kinas nya AI-kamratlag, som skulle tvinga fram nedläggningar som påverkar 345 miljoner Doubao-användare B.
Vita huset – Förväntades tillkännage frivilliga AI-modellstandarder B.
hindustantimes.comOpenAI launches GPT-Live voice models that can speak and listen at the same time