
Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is OpenAI's GPT-Bidi-1 bidirectional voice model for ChatGPT, including how it was discovere. Article summary: OpenAI's **GPT-Bidi-1** is a next-generation bidirectional voice model for ChatGPT, discovered via code and UI references in the ChatGPT web and mobile apps. It represents the largest voice-mode upgrade ever for ChatGPT,. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
OpenAI przygotowuje największą aktualizację trybu głosowego w ChatGPT – dwukierunkowy model audio o roboczej nazwie GPT-Bidi-1. W przeciwieństwie do poprzednich wersji, które czekały, aż użytkownik skończy mówić, GPT-Bidi-1 potrafi słuchać i mówić jednocześnie: przyjmować przerwy, korygować błędy na bieżąco i modyfikować odpowiedzi bez utraty ciągłości dźwięku.
W artykule wyjaśniamy, jak odkryto GPT-Bidi-1, czym różni się od dotychczasowych modeli „na zmianę”, jakie poziomy inteligencji wprowadza, jak zmienia się interfejs ChatGPT oraz w jakim kontekście konkurencyjnym powstaje. Model nie został jeszcze oficjalnie ogłoszony przez OpenAI, więc wszystkie informacje pochodzą z przecieków, analiz kodu i doniesień użytkowników.
Łańcuch odkryć rozpoczął deweloper M1Astra, który pierwszy zauważył w kodzie aplikacji ChatGPT odniesienia do gpt-bidi-1 i podzielił się tym na X. Strona TestingCatalog potwierdziła obecność tego ciągu znaków oraz tekstu zapowiedzi opisującego "następną generację Voice" i "wielki skok w inteligencji".
Następnie elementy kodu i interfejsu znaleziono zarówno w webowej, jak i mobilnej wersji ChatGPT. Ograniczone testy rozpoczęły się w małej grupie użytkowników pod koniec czerwca 2026 r. W dniach 22–24 czerwca 2026 r. pojawiły się pierwsze doniesienia i filmy demonstrujące działanie modelu w praktyce.
Zastrzeżenie: OpenAI nie wydało oficjalnego komunikatu. Ostateczna nazwa modelu, dokładne działanie poziomów ani data premiery nie zostały potwierdzone przez firmę.
Obecne tryby głosowe ChatGPT – Standardowy Głos i Zaawansowany Tryb Głosowy – działają w paradygmacie naprzemiennym (turn-based). Model musi poczekać, aż użytkownik skończy mówić, zanim odpowie. Dwukierunkowa (BiDi) architektura GPT-Bidi-1 pozwala na jednoczesne przetwarzanie dwóch strumieni audio: użytkownika i własnego.
Najważniejsze różnice widoczne w testach:
Wewnętrznym celem OpenAI było zniwelowanie luki między możliwościami głosowymi ChatGPT a jego modelami tekstowymi (które już osiągnęły poziom wnioskowania GPT-5.5).
GPT-Bidi-1 to pierwszy model głosowy OpenAI, który wprowadza trzy poziomy inteligencji i szybkości:
| Poziom | Opis |
|---|---|
| Wysoki (High) | Maksymalna głębia wnioskowania, wolniejsza odpowiedź – do złożonych analiz |
| Średni (Medium) | Równowaga między inteligencją a szybkością |
| Natychmiastowy (Instant) | Najszybsza odpowiedź, ograniczone wnioskowanie – do prostych, codziennych pytań |
System poziomów pozwala dostosować głębokość interakcji do zadania: szybkie pytanie o pogodę uruchomi tryb Instant, a burza mózgów – Wysoki.
Po wybraniu GPT-Bidi-1 wskaźnik (bańka/fala głosu) zmienia kolor na żółty. Model pojawia się w ustawieniach jako osobna opcja „Bidi (Latest)”, obok Standardowego Głosu i Zaawansowanego Trybu Głosowego – nie zastępuje ich.
gpt-bidi-1. Kontekst konkurencyjny: Dwukierunkowy głos jest bezpośrednią odpowiedzią na postępy Google (Gemini Live z możliwością przerywania), Anthropic oraz start-upów oferujących agentów głosowych czasu rzeczywistego. OpenAI spieszy się, by dorównać swoim własnym modelom tekstowym (GPT-5.5).
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
GPT Bidi 1 to nowy, dwukierunkowy model głosowy OpenAI, który umożliwia jednoczesne słuchanie i mówienie, bez czekania na zakończenie wypowiedzi.
GPT Bidi 1 to nowy, dwukierunkowy model głosowy OpenAI, który umożliwia jednoczesne słuchanie i mówienie, bez czekania na zakończenie wypowiedzi. Model wprowadza trzy poziomy inteligencji (High, Medium, Instant) oraz żółty wskaźnik w interfejsie ChatGPT.
Nowość odpowiada na konkurencję ze strony Google (Gemini Live) i Anthropic. Testy rozpoczęły się pod koniec czerwca 2026 roku.