OpenAIs API kunngjøring ble publisert 10. september 2026, ikke 11. GPT‑Live‑1 er en full dupleks stemmemodell som kan lytte og snakke samtidig, i stedet for å behandle samtalen som adskilte turer.
Publisert avBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
OpenAIs kunngjøring om API-et er datert 10. september 2026, ikke 11. september. Selskapet lanserte da GPT‑Live‑1 som en allment tilgjengelig full-dupleks stemmemodell for utviklere. Målet er at taleagenter skal oppleves mindre som en rekke spørsmål og svar, og mer som en vanlig samtale: modellen kan lytte og snakke samtidig. 3
Mange tradisjonelle taleagenter bruker en kjede der tale først blir gjort om til tekst, deretter behandlet av en språk- eller resonneringsmodell, før svaret gjøres om til syntetisk tale. Hvert ledd kan gi forsinkelse og gjøre det vanskeligere å bevare timing, sammenheng og flyt i dialogen.
GPT‑Live‑1 samler lytting og tale i én stemmemodell. Dermed kan den håndtere avbrytelser og korte bekreftelser mens de skjer, i stedet for å vente på at brukeren er helt ferdig med en ytring. En tilkoblet bakgrunnsmodell kan samtidig ta seg av dypere resonnering eller bruk av verktøy. 3
Utviklere kan la en OpenAI-modell, som GPT‑6 Astra, stå for denne bakgrunnsbehandlingen, eller bruke en tredjepartsmodell. Det lar dem avveie kvalitet på resonnering, responshastighet og kostnad ut fra oppgaven. 3
OpenAI trekker også frem styring via systeminstruksjoner for blant annet tonefall, taletempo og samtalestil. Andre funksjoner omfatter telefoniintegrasjon, håndtering av bakgrunnsstøy og stillhet, bedre stabilitet i lange økter, transkripsjoner og svartekst, gjenkjenning av bokstaver og tall samt nøkkelordvekting. 3
GPT‑Live‑1 koster 0,05 dollar per minutt for stemmesesjoner. Faktureringen skjer per sekund, uten avrunding opp til hele minutter. 2
Denne satsen dekker imidlertid bare selve stemmelaget. Bruk av bakgrunnsmodell og eventuelle verktøy belastes separat, slik at totalprisen avhenger av modellen og verktøyene utvikleren velger. 2
Det foreliggende kildematerialet underbygger ikke påstander om spesifikke bedriftsfunksjoner knyttet til «Presence», eller konkrete påstander om utvidet støtte for aksenter, dialekter og språk.
OpenAI opplyser at GPT‑Live‑1 ga en forbedring på 30 prosentpoeng i Full Duplex Bench sammenlignet med GPT‑Realtime‑2.1. Selskapet sier også at GPT‑Live‑1, sammen med GPT‑6 Astra på middels resonneringsnivå, tok førsteplass på Tau3. 3
De oppgitte kildene viser ikke de konkrete forsinkelsestallene på 1,41 og 0,798 sekunder eller passratene på 86,2 og 45,7 prosent. De eksakte tallene kan derfor ikke bekreftes ut fra materialet som er oppgitt her.
Yelp opplyser at integrering av GPT‑Live‑1 i Yelp Host og Hatch forbedret turtaking og treffsikkerhet sammenlignet med selskapets tidligere stemmearkitektur. For telefoner om bordbestilling og matbestilling rapporterte Yelp bedre håndtering av samtaler og at innringere snakket i mer komplette og naturlige ytringer. 3
Språkappen Speak sier at modellen lot språkstudenter få mer betenkningstid før veilederen svarte. Ifølge selskapet reduserte dette avbrytelser med nesten 80 prosent sammenlignet med tidligere turbaserte systemer. 3
En medgründer og teknologidirektør i et helseselskap sa at overgangen fra en kaskadekoblet løsning forenklet kodebasen med 80 prosent og fjernet 23 000 kodelinjer, noe som skulle ha bidratt til mer naturlige pasientsamtaler i sanntid. 3
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OpenAIs API kunngjøring ble publisert 10. september 2026, ikke 11.
OpenAIs API kunngjøring ble publisert 10. september 2026, ikke 11. GPT‑Live‑1 er en full dupleks stemmemodell som kan lytte og snakke samtidig, i stedet for å behandle samtalen som adskilte turer.
Modellen kan reagere på avbrytelser og små bekreftelser fortløpende, mens en separat bakgrunnsmodell kan håndtere mer krevende resonnering og verktøybruk.