GPT Live 1 стала доступна в API 10 сентября 2026 года; голосовой фронтенд стоит $0,05 за минуту, а вычисления бэкенд модели и инструменты оплачиваются отдельно. Full duplex архитектура позволяет модели слушать во время собственной речи, естественнее реагировать на перебивания, короткие подтверждения и паузы в разгов...
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is OpenAI’s GPT-Live-1 voice model, when was it released in the API and at what price, how does its full-duplex single-model architectu. Article summary: GPT‑Live‑1 is OpenAI’s flagship API voice model for natural, expressive, full‑duplex conversations: it can listen and generate speech concurrently, with smooth interruption handling. It entered the API on September 10, 2. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
GPT-Live-1 — голосовая модель OpenAI для разработчиков, рассчитанная на диалог, который больше похож на живой разговор, чем на обмен строго разделёнными репликами. Она стала доступна через API 10 сентября 2026 года. Стоимость голосового фронтенда — $0,05 за минуту; модель рассуждений, вызовы инструментов, телефония и остальная инфраструктура оплачиваются отдельно. 3
5
Обычный голосовой агент нередко строится как цепочка из трёх компонентов: распознавание речи (speech-to-text), текстовая языковая модель и синтез речи (text-to-speech). Такая схема работоспособна, но на каждом переходе между компонентами приходится отдельно управлять паузами, сменой намерения, перебиваниями и моментом передачи хода собеседнику. 3
GPT-Live-1 позиционируется как единая голосовая модель, работающая как с входящим, так и с исходящим аудио. Full-duplex означает, что она способна продолжать слушать, пока говорит сама. Это должно помочь ей отличать настоящее перебивание от короткого «да» или «понятно», а также не превращать каждую паузу, фоновую речь или разговор рядом в обязательную новую реплику. 3
Главная идея здесь не только в скорости генерации аудио. Речь о более естественном управлении диалогом: система должна понимать, что человек ещё формулирует мысль, хочет вмешаться в ответ или просто подтверждает, что слушает. OpenAI называет GPT-Live-1 своей основной моделью для естественных, выразительных голосовых бесед с плавной обработкой перебиваний. 2
3
GPT-Live-1 не обязана самостоятельно выполнять всю бизнес-логику. Она может поддерживать разговор в реальном времени, а сложные рассуждения, вызовы инструментов и действия передавать выбранной бэкенд-модели и агентному фреймворку. 3
Такой подход позволяет разработчикам строить систему из двух частей:
Например, для типового запроса о статусе заказа или записи на услугу можно выбрать более быстрый и дешёвый бэкенд. Сложные обращения можно направлять в более сильную модель, например GPT-6 Astra. OpenAI также указывает возможность подключения поддерживаемых сторонних моделей. 3
Практический вывод: объявленные $0,05 за минуту — это не полная стоимость голосового агента. Итоговая цена будет зависеть от выбранной модели рассуждений, инструментов, телефонного провайдера и прочих компонентов. 3
5
По данным OpenAI, через системный промпт можно задавать тон, темп и стиль общения модели. GPT-Live-1 также формирует транскрипты и текст ответов, понимает буквенно-цифровые данные, поддерживает смещение в пользу ключевых слов и умеет определять границы реплик — если приложению всё же нужен явный режим «говорит один, затем другой». 3
Модель рассчитана на длительные сессии и телефонных агентов: в частности, на поддержку клиентов и бронирования. OpenAI заявляет, что она может корректно вести себя при тишине и фоновом шуме, не озвучивая каждый внутренний шаг рассуждений. Это важно для обычных звонков, где звук редко бывает идеально чистым. 3
В предоставленных материалах нет окончательного перечня поддерживаемых языков и нет достаточно подробной информации о настройках конкретных акцентов и диалектов. Перед внедрением эти параметры следует сверять с актуальной документацией API.
OpenAI сообщает, что GPT-Live-1 превосходит GPT-Realtime-2.1 на 30 процентных пунктов в Full Duplex Bench — тесте интерактивного голосового поведения. Он оценивает, в частности, очередность реплик, паузы, перебивания, короткие подтверждения и фоновую речь. 3
В связке с GPT-6 Astra при среднем уровне усилий на рассуждения GPT-Live-1 также заняла первое место в Tau3 — комплексном бенчмарке голосовых агентов. Его часть, посвящённая поддержке клиентов, включает устные задачи из сфер авиаперевозок, розницы и телекоммуникаций. 3
Вторичные публикации приводят точные показатели задержки передачи хода и баллов Tau3, однако в предоставленном фрагменте первоисточника таких чисел нет. Поэтому корректнее говорить о заявленном существенном улучшении интерактивного поведения и первом месте конфигурации GPT-Live-1 с Astra, а не ожидать одинаковых чисел в каждом внедрении. 3
7
OpenAI приводит несколько примеров внедрения голосовых агентов:
Именно в таких ситуациях full-duplex особенно полезен: звонящий может запнуться, поправить себя, подтвердить услышанное посреди фразы или перебить агента, не желая при этом начинать весь диалог заново.
Тариф GPT-Live-1 составляет $0,05 за минуту голосового фронтенда. Разработчик может подключить удобную ему бэкенд-модель и агентную инфраструктуру, но эти компоненты увеличивают общую стоимость и тарифицируются отдельно. 3
5
OpenAI также называет OpenAI Presence ещё одним способом создавать голосовые процессы на базе GPT-Live-1 для взаимодействия в реальном времени. Однако предоставленные материалы не раскрывают требования к корпоративному доступу, коммерческие условия, модель хостинга или порядок подключения Presence. Эти детали нельзя выводить только из анонса API. 3
При оценке GPT-Live-1 команде стоит смотреть не только на ставку за минуту. Более важные вопросы: насколько плавное ведение диалога улучшит конкретный процесс и какой набор бэкенд-модели, инструментов и телефонии обеспечит нужную надёжность при приемлемой полной стоимости.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
GPT Live 1 стала доступна в API 10 сентября 2026 года; голосовой фронтенд стоит $0,05 за минуту, а вычисления бэкенд модели и инструменты оплачиваются отдельно.
GPT Live 1 стала доступна в API 10 сентября 2026 года; голосовой фронтенд стоит $0,05 за минуту, а вычисления бэкенд модели и инструменты оплачиваются отдельно. Full duplex архитектура позволяет модели слушать во время собственной речи, естественнее реагировать на перебивания, короткие подтверждения и паузы в разговоре.
OpenAI заявляет прирост на 30 процентных пунктов относительно GPT Realtime 2.1 в Full Duplex Bench и первое место в Tau3 в связке с GPT 6 Astra при среднем уровне рассуждений.