GPT‑Live‑1 стала общедоступна в API OpenAI 10 сентября 2026 года. Модель одновременно слушает и говорит, а рассуждения и инструменты может обслуживать отдельный бэкенд.
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT-Live-1 full-duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11. It introduced GPT‑Live‑1 as a generally available, full‑duplex voice layer: a model intended to make voice agents more natural by listening and spe. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
OpenAI объявила об общедоступности GPT‑Live‑1 в API 10 сентября 2026 года, а не 11 сентября. Это голосовая модель для приложений и рабочих процессов, которая способна одновременно слушать собеседника и отвечать ему — без строго разделённых, завершённых речевых ходов. 1
16
Обычный голосовой агент часто строится как последовательная цепочка: распознавание речи переводит аудио в текст, языковая модель формирует ответ, затем синтез речи озвучивает его. GPT‑Live‑1 позиционируется как единый голосовой слой для той части диалога, где особенно важны реакция в реальном времени и естественный ритм беседы. 1
Ключевое отличие — управление очередностью реплик. По данным OpenAI, GPT‑Live‑1 может слушать и говорить параллельно, учитывать паузы и изменения темпа, а также решать по ходу разговора, отвечать ли уже сейчас или продолжать слушать. Поэтому перебивания и короткие реплики-подтверждения могут восприниматься не как сбой, а как нормальная часть общения. 1
9
15
Это не означает, что голосовая модель обязана самостоятельно выполнять все задачи. Пока GPT‑Live‑1 ведёт разговор, бэкендовая модель или агент может заниматься более глубокими рассуждениями либо работать с инструментами. OpenAI предлагает делегирование через Responses с моделью OpenAI или клиентское делегирование для подключения собственного бэкенда разработчика. 1
16
GPT‑Live‑1 выступает фронтенд-слоем живого голосового диалога: слушает, говорит и управляет таймингом разговора. Бэкенд при этом может отвечать за более сложные рассуждения, поиск и получение данных, выполнение сценариев или вызовы инструментов.
В заметках OpenAI для продуктов компании GPT‑6 Astra названа одним из вариантов для трудных задач поиска и рассуждений; разработчики API также могут подключить свой бэкенд через клиентское делегирование. 4
16
Для команд это разделение означает следующее:
Для API OpenAI также заявила улучшенное следование инструкциям, пользовательские голоса и поддержку телефонии. 13
Голосовой сеанс GPT‑Live‑1 стоит $0,05 за минуту. Оплата рассчитывается посекундно: время не округляется до полной минуты. 16
18
Это тариф именно за голосовой сеанс, а не за весь голосовой агент. Использование бэкендовой модели и инструментов оплачивается отдельно. Поэтому при расчёте бюджета нужно учитывать и длительность разговоров, и объём задач, передаваемых на бэкенд. 16
18
OpenAI сообщила, что GPT‑Live‑1 превзошла GPT‑Realtime‑2.1 на 30 процентных пунктов в собственном Full Duplex Bench, а связка GPT‑Live‑1 и GPT‑6 Astra со средним уровнем рассуждений заняла первое место в Tau3. 1
При этом предоставленные материалы не позволяют независимо подтвердить точные значения задержки смены реплики и конкретное сравнение показателей прохождения Tau3, упомянутые в исходном вопросе. Эти цифры не следует считать подтверждёнными в рамках имеющихся источников.
OpenAI привела несколько примеров промышленного использования, в которых более естественная очередность реплик стала главным эффектом:
Это результаты, заявленные самими компаниями, а не независимые оценки. Их корректнее воспринимать как примеры внедрения, а не как гарантию аналогичного эффекта для любого проекта.
Имеющиеся источники не подтверждают доступ для корпоративных клиентов через управляемый продукт под названием «Presence». Также они не устанавливают конкретное расширение набора акцентов, диалектов или языков именно в рамках этого запуска API. Перед закупкой или внедрением эти детали стоит проверить в актуальной документации OpenAI.
Основное новшество GPT‑Live‑1 — архитектурное. API получает полнодуплексный голосовой слой, который позволяет агенту естественнее слушать и говорить, пока отдельная система выполняет более медленные рассуждения или вызывает инструменты. Тариф $0,05 за минуту с посекундным учётом делает стоимость голосового времени понятной, однако итоговая цена решения всё равно зависит от выбранной бэкендовой модели и инструментов. 1
16
18
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
GPT‑Live‑1 стала общедоступна в API OpenAI 10 сентября 2026 года. Модель одновременно слушает и говорит, а рассуждения и инструменты может обслуживать отдельный бэкенд.
GPT‑Live‑1 стала общедоступна в API OpenAI 10 сентября 2026 года. Модель одновременно слушает и говорит, а рассуждения и инструменты может обслуживать отдельный бэкенд. Вместо жёсткой схемы «пользователь договорил — агент ответил» система рассчитана на паузы, перебивания, короткие подтверждающие реплики и смену хода разговора в реальном времени.
Голосовой сеанс стоит $0,05 за минуту с посекундным биллингом, но использование модели для рассуждений и инструментов оплачивается отдельно.