API julkaisu oli 10. syyskuuta 2026, ei 11. GPT Live 1 kuuntelee ja puhuu samanaikaisesti, toisin kuin perinteinen puheentunnistus–kielimalli–puhesynteesi ketju.
JulkaisijaKuvat luotu mallilla GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
OpenAI ilmoitti 10. syyskuuta 2026 — ei 11. syyskuuta — GPT-Live-1:n yleisestä saatavuudesta APIssa. Kyse on täysdupleksisesta äänikerroksesta, jonka tavoitteena on tehdä puheagenteista luonnollisempia: malli voi kuunnella ja puhua samanaikaisesti sen sijaan, että keskustelu etenisi jäykkinä, erillisinä vuoroina. 3
Tavanomainen puheagentti rakentuu ketjusta: puhe muutetaan ensin tekstiksi, kieli- tai päättelymalli käsittelee tekstin ja lopuksi vastaus muunnetaan puheeksi. Jokainen vaihe lisää viivettä ja voi häivyttää keskustelun ajoitusta, kontekstia ja luonnollista rytmiä. GPT-Live-1 yhdistää kuuntelun ja puhumisen yhdeksi äänimalliksi. 3
Käytännössä tämä tarkoittaa, että malli voi reagoida puhujan keskeytyksiin ja pieniin myöntelyihin niiden tapahtuessa. Syvempää päättelyä tai työkalujen käyttöä voidaan samalla hoitaa taustalla erillisen taustamallin avulla. 3
Kehittäjä voi valita taustalle OpenAI-mallin, kuten GPT-6 Astran, tai kolmannen osapuolen mallin. Valinta mahdollistaa kompromissin päättelykyvyn, nopeuden ja kustannusten välillä käyttötarkoituksen mukaan. 3
OpenAI nosti esiin myös järjestelmäkehotteilla säädettävät äänen sävyn, puhenopeuden ja keskustelutyylin. Lisäksi mallia on tarkoitus hyödyntää puhelinjärjestelmissä, ja siinä on ominaisuuksia taustamelun ja hiljaisuuden käsittelyyn, pitkiin istuntoihin, litteraatteihin ja vastaustekstiin, aakkosnumeeristen merkkien tunnistukseen sekä avainsanojen painottamiseen. 3
GPT-Live-1:n äänisessio maksaa 0,05 Yhdysvaltain dollaria minuutilta. Laskutus tehdään sekuntiperusteisesti, joten aikaa ei pyöristetä ylöspäin kokonaisiksi minuuteiksi. 2
Tämä hinta koskee äänikerrosta. Taustalla käytetyn mallin ja mahdollisten työkalujen käyttö laskutetaan erikseen, joten kokonaiskulu muodostuu äänisession hinnasta sekä valittujen mallien ja työkalujen käytöstä. 2
Toimitetut lähteet eivät vahvista väitteitä hallinnoidusta "Presence"-yrityskäytöstä tai tietystä aksenttien, murteiden ja kielten tuen laajennuksesta.
OpenAI kertoi GPT-Live-1:n parantaneen Full Duplex Bench -tulosta 30 prosenttiyksikköä GPT-Realtime-2.1:een verrattuna. GPT-Live-1:n ja keskitasoisella päättelyasetuksella käytetyn GPT-6 Astran kerrottiin sijoittuneen ensimmäiseksi Tau3-arvioinnissa. 3
Lähdeaineisto tukee näitä yleisiä vertailuväitteitä, mutta ei esitä itsenäisesti väitettyjä tarkkoja latenssilukuja tai Tau3-läpäisyprosentteja. Siksi niitä ei voi vahvistaa toimitetun aineiston perusteella.
Varhaisista käyttäjistä Yelp kertoi GPT-Live-1:n parantaneen vuorottelua ja tarkkuutta Yelp Host- ja Hatch-palveluissa verrattuna aiempaan ääniarkkitehtuuriin. Varaus- ja ruokatilauspuheluissa yhtiö raportoi paremmista puheluiden käsittelyluvuista sekä siitä, että soittajat puhuivat pidemmin ja luonnollisemmin. 3
Kieltenoppimispalvelu Speak puolestaan kertoi mallin antavan oppijoille enemmän ajatteluaikaa ennen opettajan vastausta. Yhtiön mukaan keskeytykset vähenivät lähes 80 prosenttia aiempiin vuoropohjaisiin järjestelmiin verrattuna. 3
Erään terveydenhuoltoalan yrityksen perustaja ja teknologiajohtaja sanoi, että ketjutetun toteutuksen korvaaminen yksinkertaisti koodipohjaa 80 prosenttia ja poisti 23 000 koodiriviä. Tavoitteena oli luonnollisempi reaaliaikainen keskustelu potilaiden kanssa. 3
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
API julkaisu oli 10. syyskuuta 2026, ei 11.
API julkaisu oli 10. syyskuuta 2026, ei 11. GPT Live 1 kuuntelee ja puhuu samanaikaisesti, toisin kuin perinteinen puheentunnistus–kielimalli–puhesynteesi ketju.
Äänikerros maksaa 0,05 dollaria minuutilta ja laskutus tapahtuu sekunneittain; taustamallien ja työkalujen käyttö veloitetaan erikseen.