OpenAI sta preparando GPT Bidi 1, un modello vocale bidirezionale che permette a ChatGPT di ascoltare e parlare contemporaneamente, gestendo le interruzioni senza blocchi. Il modello introduce tre livelli di intelligenza selezionabili (High, Medium, Instant) per adattare la profondità di ragionamento alla velocità d...
Research answer

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is OpenAI's GPT-Bidi-1 bidirectional voice model for ChatGPT, including how it was discovere. Article summary: OpenAI's **GPT-Bidi-1** is a next-generation bidirectional voice model for ChatGPT, discovered via code and UI references in the ChatGPT web and mobile apps. It represents the largest voice-mode upgrade ever for ChatGPT,. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
OpenAI si prepara a lanciare il più grande aggiornamento della modalità vocale di ChatGPT: un modello audio bidirezionale chiamato internamente GPT-Bidi-1. A differenza di tutte le precedenti modalità vocali di ChatGPT, che aspettano che l'utente finisca di parlare prima di rispondere, GPT-Bidi-1 è in grado di ascoltare e parlare allo stesso tempo — assorbendo le interruzioni, correggendo gli errori in tempo reale e adattando le risposte senza interrompere il flusso audio.
Questo articolo spiega come è stato scoperto GPT-Bidi-1, cosa lo differenzia dalla voce a turni, i tre livelli di intelligenza che introduce, il cambiamento visivo nell'interfaccia di ChatGPT e il contesto competitivo del suo sviluppo. Il modello non è stato ancora annunciato ufficialmente da OpenAI, quindi tutti i dettagli provengono da avvistamenti nel codice, riferimenti nell'interfaccia utente, segnalazioni di utenti e analisi della stampa specializzata.
La catena delle scoperte è iniziata con lo sviluppatore M1Astra, che per primo ha individuato riferimenti a gpt-bidi-1 nel codice dell'app di ChatGPT e ha condiviso la scoperta su X. Il sito di tracking TestingCatalog ha poi confermato la stringa del modello, insieme a quello che sembrava essere il testo di un annuncio che descriveva "la prossima generazione di Voice" e un "grande balzo nell'intelligenza".
Successivamente, sono stati trovati elementi di codice e dell'interfaccia utente sia sul web che sui client mobili di ChatGPT. Test limitati hanno iniziato a raggiungere un piccolo gruppo di utenti alla fine di giugno 2026. Tra il 22 e il 24 giugno 2026, sono emerse numerose segnalazioni di utenti e video dimostrativi che mostravano il modello funzionare in modalità bidirezionale.
Attenzione: OpenAI non ha rilasciato alcun annuncio ufficiale. Il nome finale del modello, il comportamento esatto dei livelli e la data di lancio rimangono non confermati dall'azienda.
Le attuali modalità vocali di ChatGPT — Voce Standard e Modalità Vocale Avanzata — operano in un paradigma a turni. Il modello deve aspettare che l'utente finisca di parlare prima di poter rispondere. L'architettura bidirezionale (BiDi) di GPT-Bidi-1 consente al modello di elaborare due flussi audio contemporaneamente: il tuo e il suo.
Le principali differenze comportamentali emerse dalle dimostrazioni:
L'obiettivo interno di OpenAI era colmare il divario tra lo stack vocale di ChatGPT — che era in ritardo rispetto ai suoi modelli di testo (già a livello di ragionamento GPT-5.5) — e fornire parità di intelligenza conversazionale in tempo reale.
GPT-Bidi-1 è il primo modello vocale di OpenAI a introdurre tre livelli di intelligenza e velocità selezionabili per la voce:
| Livello | Descrizione |
|---|---|
| High | Massima profondità di ragionamento, risposta più lenta — per attività di analisi complesse |
| Medium | Compromesso equilibrato tra intelligenza e velocità |
| Instant | Risposta più veloce possibile, ragionamento ridotto — per interazioni casuali o urgenti |
Il sistema a livelli consente agli utenti di adattare la profondità dell'interazione rispetto alla latenza per ogni attività, in modo simile a come i modelli di testo di ChatGPT offrono diversi livelli di ragionamento. Ad esempio, una rapida richiesta sul meteo utilizzerebbe Instant, mentre una sessione di brainstorming approfondita passerebbe a High.
Quando si seleziona GPT-Bidi-1, la bolla vocale/indicatore d'onda diventa gialla invece del colore predefinito attuale. Il modello appare nel selettore dei modelli delle impostazioni come una nuova opzione etichettata "Bidi (Latest)" insieme alla Voce Standard e alla Modalità Vocale Avanzata esistenti, senza sostituirle.
gpt-bidi-1. Contesto competitivo: La spinta verso la voce bidirezionale risponde direttamente ai progressi di Google (Gemini Live con interruzioni), Anthropic e agli agenti vocali in tempo reale delle startup. OpenAI sta correndo per portare la parità di interazione vocale alla sua intelligenza testuale, che già alimenta il ragionamento di livello GPT-5.5.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OpenAI sta preparando GPT Bidi 1, un modello vocale bidirezionale che permette a ChatGPT di ascoltare e parlare contemporaneamente, gestendo le interruzioni senza blocchi.
OpenAI sta preparando GPT Bidi 1, un modello vocale bidirezionale che permette a ChatGPT di ascoltare e parlare contemporaneamente, gestendo le interruzioni senza blocchi. Il modello introduce tre livelli di intelligenza selezionabili (High, Medium, Instant) per adattare la profondità di ragionamento alla velocità di risposta.
La scoperta è avvenuta grazie a sviluppatori e siti di tracking che hanno individuato riferimenti nel codice dell'app di ChatGPT a giugno 2026.