GPT Live 1 trafił do API OpenAI w ramach ogólnej dostępności 10 września 2026 r. Zamiast czekać na wyraźny koniec wypowiedzi użytkownika, system ma reagować na pauzy, przerwania, krótkie potwierdzenia i zmianę toku rozmowy w czasie rzeczywistym.
Opublikowane przezEdytowane za pomocą GPT-5.6 TerraObrazy wygenerowane za pomocą GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT-Live-1 full-duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11. It introduced GPT‑Live‑1 as a generally available, full‑duplex voice layer: a model intended to make voice agents more natural by listening and spe. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
OpenAI ogłosiło ogólną dostępność GPT-Live-1 w API 10 września 2026 r., a nie 11 września. To model przeznaczony do budowania agentów głosowych, które nie muszą traktować rozmowy jak serii ściśle oddzielonych tur: mogą słuchać i mówić równocześnie. 1
16
W klasycznym agencie głosowym rozmowa zwykle przechodzi przez łańcuch: rozpoznawanie mowy zamienia dźwięk na tekst, model językowy układa odpowiedź, a synteza mowy odczytuje ją użytkownikowi. GPT-Live-1 ma stanowić jedną warstwę głosową dla interakcji prowadzonych w czasie rzeczywistym. 1
Najważniejsza różnica dotyczy zmiany ról w rozmowie. Według OpenAI model może jednocześnie słuchać i mówić, śledzić pauzy oraz zmianę tempa i na bieżąco oceniać, czy powinien odpowiedzieć, czy nadal słuchać. Dzięki temu przerwania i krótkie potwierdzenia typu „mhm” — nazywane też sygnałami podtrzymującymi rozmowę — mają być obsługiwane jako naturalny element dialogu, a nie błąd. 1
9
15
Nie oznacza to, że sam model głosowy musi wykonywać każde zadanie. Rozmowa z GPT-Live-1 może toczyć się dalej, gdy model lub agent backendowy realizuje bardziej złożone rozumowanie albo korzysta z narzędzi. OpenAI udostępnia delegowanie przez Responses do modelu OpenAI oraz delegowanie klienta, które pozwala podłączyć własne zaplecze dewelopera. 1
16
GPT-Live-1 pełni rolę frontowej warstwy konwersacyjnej: słucha, mówi i zarządza rytmem dialogu. Backend może natomiast odpowiadać za wyszukiwanie informacji, bardziej wymagające rozumowanie, obsługę procesów biznesowych albo wywołania narzędzi. W informacjach produktowych OpenAI wskazano GPT-6 Astra jako jedną z opcji dla trudniejszych zadań związanych z wyszukiwaniem i rozumowaniem; twórcy korzystający z API mogą też podłączyć własny backend przez delegowanie klienta. 4
16
Dla zespołów budujących produkt oznacza to podział odpowiedzialności:
OpenAI podkreśla także lepsze wykonywanie instrukcji, możliwość korzystania z niestandardowych głosów oraz wsparcie dla telefonii. 13
Sesje głosowe GPT-Live-1 kosztują 0,05 USD za minutę. Rozliczenie odbywa się co sekundę, bez zaokrąglania do pełnej minuty. 16
18
To cena samej sesji głosowej, a nie pełnego działania agenta. Użycie modelu backendowego oraz narzędzi jest rozliczane oddzielnie. Przy planowaniu kosztów produkcyjnych trzeba więc uwzględnić zarówno długość rozmowy, jak i pracę wykonywaną przez system działający w tle. 16
18
OpenAI podało, że GPT-Live-1 uzyskał wynik wyższy o 30 punktów procentowych w teście Full Duplex Bench względem GPT-Realtime-2.1. Firma poinformowała też, że połączenie GPT-Live-1 z GPT-6 Astra przy średnim poziomie wysiłku rozumowania zajęło pierwsze miejsce w teście Tau3. 1
Dostarczone materiały nie potwierdzają jednak niezależnie konkretnych wartości opóźnienia zmiany tury ani dokładnego porównania wskaźników zaliczenia w Tau3 przywołanych w pytaniu. Tych precyzyjnych liczb nie należy więc na podstawie tego zestawu źródeł uznawać za zweryfikowane.
OpenAI przytoczyło przykłady wdrożeń produkcyjnych, które mają pokazywać korzyści z bardziej naturalnego prowadzenia rozmowy:
Są to deklaracje firm dotyczące własnych wdrożeń, a nie niezależne testy. Należy je traktować jako przykłady użycia, nie jako uniwersalną gwarancję rezultatów.
Dostępne materiały nie potwierdzają twierdzeń o dostępie dla przedsiębiorstw przez zarządzany produkt o nazwie „Presence”. Nie wykazują też konkretnego rozszerzenia obsługi akcentów, dialektów ani języków w ramach tej premiery API. Przed zakupem lub wdrożeniem takie informacje warto sprawdzić bezpośrednio w aktualnej dokumentacji OpenAI.
Kluczowa zmiana w GPT-Live-1 ma charakter architektoniczny: API otrzymuje warstwę głosową full-duplex, która może prowadzić naturalniejszy dialog, podczas gdy osobny system zajmuje się wolniejszym rozumowaniem i narzędziami. Stawka 0,05 USD za minutę, naliczana co sekundę, upraszcza wycenę czasu rozmowy — jednak pełny koszt rozwiązania nadal zależy od wybranego backendu i używanych narzędzi. 1
16
18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
GPT Live 1 trafił do API OpenAI w ramach ogólnej dostępności 10 września 2026 r.
GPT Live 1 trafił do API OpenAI w ramach ogólnej dostępności 10 września 2026 r. Zamiast czekać na wyraźny koniec wypowiedzi użytkownika, system ma reagować na pauzy, przerwania, krótkie potwierdzenia i zmianę toku rozmowy w czasie rzeczywistym.
Stawka za sesję głosową wynosi 0,05 USD za minutę i jest naliczana co sekundę. Koszty modelu backendowego oraz narzędzi są rozliczane osobno.