GPT Live 1 è diventato generalmente disponibile nelle API OpenAI il 10 settembre 2026. Al posto di un dialogo a turni rigidi, il sistema è progettato per gestire pause, interruzioni, brevi segnali di ascolto e cambi di direzione della conversazione in tempo reale.
Pubblicato daModificato con GPT-5.6 TerraImmagini generate con GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT-Live-1 full-duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11. It introduced GPT‑Live‑1 as a generally available, full‑duplex voice layer: a model intended to make voice agents more natural by listening and spe. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
OpenAI ha reso GPT-Live-1 generalmente disponibile nelle sue API il 10 settembre 2026, e non l’11 settembre. Il rilascio offre agli sviluppatori un livello vocale per creare agenti capaci di ascoltare e parlare nello stesso momento, invece di trattare ogni scambio come una sequenza di turni chiusi e rigidamente separati. 1
16
Molti agenti vocali seguono una catena in tre passaggi: il riconoscimento vocale converte l’audio in testo, un modello linguistico produce la risposta e la sintesi vocale la trasforma di nuovo in audio. GPT-Live-1 viene presentato come un livello unificato per la parte conversazionale in tempo reale di questo processo. 1
La differenza pratica sta nella gestione dei turni di parola. Secondo OpenAI, GPT-Live-1 può ascoltare e parlare simultaneamente, seguire pause e variazioni di ritmo e decidere se intervenire oppure continuare ad ascoltare. In questo modo, interruzioni e brevi segnali di attenzione dell’interlocutore — i cosiddetti backchannel, come un «sì» o un «capisco» — dovrebbero assomigliare meno a un errore del sistema e di più a una conversazione naturale. 1
9
15
Il modello vocale non deve però svolgere da solo ogni attività. La conversazione con GPT-Live-1 può proseguire mentre un modello o un agente backend esegue ragionamenti più approfonditi o utilizza strumenti. OpenAI supporta la delega tramite Responses verso un modello OpenAI e la delega lato client verso il backend scelto dallo sviluppatore. 1
16
GPT-Live-1 agisce quindi come livello vocale e conversazionale in prima linea. Il backend può gestire ragionamenti più articolati, recupero di informazioni, esecuzione di workflow o chiamate a strumenti. Nelle note sui prodotti OpenAI, GPT-6 Astra è indicato come opzione per ricerche e ragionamenti più difficili; chi usa le API può anche collegare un proprio backend tramite client delegation. 4
16
Per chi sviluppa, questa architettura separa i compiti:
OpenAI ha inoltre segnalato un migliore rispetto delle istruzioni, voci personalizzate e supporto per la telefonia. 13
Le sessioni vocali GPT-Live-1 costano 0,05 dollari al minuto. La fatturazione avviene al secondo, senza arrotondare al minuto intero successivo. 16
18
Questa tariffa riguarda la sessione vocale, non necessariamente il costo complessivo di un agente telefonico o vocale. L’uso del modello backend e degli strumenti viene addebitato a parte: per stimare un impiego in produzione occorre dunque considerare sia la durata della conversazione sia il lavoro delegato in secondo piano. 16
18
OpenAI ha dichiarato un miglioramento di 30 punti percentuali nel proprio Full Duplex Bench rispetto a GPT-Realtime-2.1. Ha inoltre affermato che GPT-Live-1, abbinato a GPT-6 Astra con sforzo di ragionamento medio, si è classificato primo su Tau3. 1
Le fonti fornite non confermano però in modo indipendente i valori specifici citati per la latenza nella presa del turno né il confronto esatto dei tassi di superamento su Tau3. Quei numeri puntuali non vanno quindi considerati verificati in questo contesto.
OpenAI ha citato alcune implementazioni in produzione per illustrare il valore di una gestione del turno più naturale:
Si tratta di risultati comunicati dalle aziende coinvolte, non di valutazioni indipendenti: vanno letti come esempi di impiego, non come garanzie di prestazioni generalizzabili.
Il materiale disponibile non documenta l’accesso enterprise tramite un prodotto gestito chiamato “Presence”, né dimostra una precisa estensione di accenti, dialetti o lingue in occasione di questo lancio API. Prima di usare tali elementi per acquisti o decisioni di implementazione, è opportuno verificarli direttamente nella documentazione OpenAI aggiornata.
La novità principale di GPT-Live-1 è architetturale: porta nelle API un livello vocale full-duplex che può mantenere più naturale l’ascolto e la risposta, mentre un sistema separato si occupa di ragionamenti più lenti o dell’uso di strumenti. Il prezzo di 0,05 dollari al minuto per la voce, fatturato al secondo, rende chiaro il costo del tempo di conversazione; il costo totale dipenderà comunque dal modello backend e dagli strumenti scelti. 1
16
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
GPT Live 1 è diventato generalmente disponibile nelle API OpenAI il 10 settembre 2026.
GPT Live 1 è diventato generalmente disponibile nelle API OpenAI il 10 settembre 2026. Al posto di un dialogo a turni rigidi, il sistema è progettato per gestire pause, interruzioni, brevi segnali di ascolto e cambi di direzione della conversazione in tempo reale.
La componente vocale costa 0,05 dollari al minuto, con addebito al secondo; modelli backend e strumenti sono fatturati separatamente.