GPT Live 1 kwam op 10 september 2026 beschikbaar in de API en kost $ 0,05 per minuut voor de front end spraaklaag. Dankzij full duplex kan het model blijven luisteren terwijl het praat, waardoor onderbrekingen, korte bevestigingen en stiltes natuurlijker kunnen worden afgehandeld.
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is OpenAI’s GPT-Live-1 voice model, when was it released in the API and at what price, how does its full-duplex single-model architectu. Article summary: GPT‑Live‑1 is OpenAI’s flagship API voice model for natural, expressive, full‑duplex conversations: it can listen and generate speech concurrently, with smooth interruption handling. It entered the API on September 10, 2. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
GPT-Live-1 is OpenAI’s ontwikkelaarsmodel voor spraakgesprekken die minder aanvoelen als losse vraag-en-antwoordbeurten en meer als een live gesprek. Het model kwam op 10 september 2026 beschikbaar via de API. De front-end-spraaklaag kost $ 0,05 per minuut; voor het redeneermodel, tools en overige infrastructuur daarachter betalen teams apart. 3
5
Veel spraakagents gebruiken een keten van drie onderdelen: spraak-naar-tekst zet de stem van de beller om, een taalmodel formuleert een tekstantwoord en tekst-naar-spraak maakt daar weer audio van. Dat kan goed werken, maar iedere stap is een overdracht. De applicatie moet zelf het juiste moment voor stiltes, wijzigingen van bedoeling en onderbrekingen coördineren. 3
GPT-Live-1 is opgezet als één spraakmodel dat met inkomende én uitgaande audio werkt. Door het full-duplexontwerp kan het model blijven luisteren terwijl het zelf spreekt. Daardoor kan het reageren als iemand onderbreekt of kort instemt, zonder dat elk geluid, elke stilte of een gesprek op de achtergrond meteen als een nieuwe beurt moet worden gezien. 3
Het gaat dus niet alleen om sneller audio genereren, maar vooral om gespreksregie: herkennen dat iemand nog nadenkt, de AI in de rede valt, of met een kort „ja” slechts laat merken dat hij of zij luistert. OpenAI omschrijft GPT-Live-1 als zijn belangrijkste model voor natuurlijke, expressieve spraakgesprekken met soepele afhandeling van onderbrekingen. 2
3
GPT-Live-1 hoeft niet alle bedrijfslogica zelf uit te voeren. Het kan het realtimegesprek voeren en tegelijk zwaarder redeneerwerk, toolaanroepen of acties uitbesteden aan een afzonderlijk backendmodel en agentframework. 3
Dat geeft ontwikkelaars een praktische keuze:
In feite ontstaat zo een systeem met twee lagen: GPT-Live-1 beheert de live spraakinteractie, terwijl de backend redeneerwerk, bedrijfsdata en handelingen levert. De geadverteerde prijs voor spraak is daarom niet de totale prijs van een agent: inferentie aan de achterkant, tools, telefonie en aanverwante diensten kunnen de rekening verhogen. 3
5
Volgens OpenAI kunnen ontwikkelaars via de systeemprompt sturing geven aan toon, tempo en gespreksstijl. GPT-Live-1 levert ook transcripties en antwoordtekst, ondersteunt begrip van alfanumerieke invoer en keyword biasing, en biedt beurtendetectie voor toepassingen die toch expliciete beurtgrenzen nodig hebben. 3
Het model is bedoeld voor langere sessies en telefoonagents, bijvoorbeeld voor klantenservice en reserveringen. OpenAI stelt dat GPT-Live-1 stiltes en achtergrondgeluid kan verwerken zonder elke interne stap hardop te beschrijven — een relevant gedrag bij echte telefoongesprekken en andere minder gecontroleerde omgevingen. 3
In de beschikbare documentatie staat geen definitieve lijst met ondersteunde talen of uitgebreide ontwikkelaarsinstellingen voor specifieke accenten en dialecten. Wie zulke eisen heeft, doet er goed aan de actuele API-documentatie te controleren voordat het model wordt uitgerold.
OpenAI meldt dat GPT-Live-1 op Full Duplex Bench 30 procentpunt beter presteert dan GPT-Realtime-2.1. Die test richt zich op interactief spraakgedrag, waaronder beurtwisseling, pauzes, onderbrekingen, korte bevestigingen en achtergrondspraak. 3
In combinatie met GPT-6 Astra op een gemiddeld redeneerniveau behaalde GPT-Live-1 volgens OpenAI ook de eerste plaats op Tau3, een benchmark voor end-to-end-spraakagents. Het klantenserviceonderdeel omvat gesproken taken in de luchtvaart-, retail- en telecomsector. 3
Sommige secundaire publicaties noemen exacte cijfers voor beurtwisselingsvertraging en Tau3-scores. Het hier beschikbare primaire bronmateriaal bevat die precieze waarden echter niet. De beter onderbouwde conclusie is daarom dat OpenAI duidelijke vooruitgang in interactief gedrag rapporteert, plus een toppositie op Tau3 voor de combinatie GPT-Live-1 en Astra — niet dat iedere implementatie een specifiek benchmarkcijfer zal evenaren. 3
7
OpenAI noemt enkele vroege toepassingen van spraakagents:
Deze voorbeelden laten zien waar full duplex het meeste verschil kan maken: gesprekken waarin een beller aarzelt, zichzelf corrigeert, midden in een antwoord iets bevestigt of een agent onderbreekt zonder de hele interactie opnieuw te willen beginnen.
GPT-Live-1 kost $ 0,05 per minuut voor de front-end-spraaklaag. Ontwikkelaars kunnen zelf een backendmodel en agentopzet kiezen, maar die keuzes bepalen mede de totale kosten omdat ze los van de spraaklaag worden afgerekend. 3
5
OpenAI noemt OpenAI Presence ook als manier om spraakworkflows te bouwen met GPT-Live-1 voor realtime spraakinteractie. Het aangeleverde materiaal geeft echter geen duidelijkheid over eventuele enterprisevoorwaarden, commerciële afspraken, hosting of de toegangsprocedure van Presence. Die details zijn dus niet af te leiden uit alleen de API-aankondiging. 3
Voor teams die GPT-Live-1 beoordelen, is de kernvraag dan ook breder dan de prijs per minuut: hoeveel waarde levert natuurlijkere beurtwisseling op voor de beoogde workflow, en welke combinatie van backendmodel en tools biedt voldoende betrouwbaarheid tegen aanvaardbare totale kosten?
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
GPT Live 1 kwam op 10 september 2026 beschikbaar in de API en kost $ 0,05 per minuut voor de front end spraaklaag.
GPT Live 1 kwam op 10 september 2026 beschikbaar in de API en kost $ 0,05 per minuut voor de front end spraaklaag. Dankzij full duplex kan het model blijven luisteren terwijl het praat, waardoor onderbrekingen, korte bevestigingen en stiltes natuurlijker kunnen worden afgehandeld.
OpenAI rapporteert 30 procentpunt betere prestaties dan GPT Realtime 2.1 op Full Duplex Bench en een eerste plaats op Tau3 in combinatie met GPT 6 Astra.