OpenAI объявила о запуске GPT‑Live‑1 в API 10 сентября 2026 года, а не 11 сентября. Модель работает в full duplex режиме: она способна одновременно слушать собеседника и говорить, а не обрабатывать разговор строго по очереди.
ОпубликовалИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
OpenAI объявила о запуске GPT‑Live‑1 в API 10 сентября 2026 года, а не 11 сентября. Модель стала общедоступным голосовым слоем для приложений и бизнес-процессов, рассчитанным на более естественный диалог: она может слушать человека и говорить одновременно. 3
Во многих традиционных системах голос проходит через последовательную цепочку: сначала речь преобразуется в текст (speech-to-text), затем текст обрабатывает языковая или reasoning-модель, после чего ответ превращается в аудио (text-to-speech). Каждый такой переход добавляет задержку и способен ухудшать передачу интонации, тайминга, контекста и естественного ритма разговора. 3
GPT‑Live‑1 объединяет слушание и речь в одной голосовой модели. Это full-duplex-подход: система не обязана ждать полного окончания реплики, прежде чем начать реагировать. 3
Практически это означает, что голосовой агент может:
Разработчик может передавать такие задачи модели OpenAI — например, GPT‑6 Astra — либо сторонней модели, выбирая баланс между качеством рассуждений, скоростью и стоимостью. 3
OpenAI выделила управление через системные инструкции: можно настраивать тон, темп речи и стиль беседы. Также для модели заявлены поддержка телефонных сценариев, обработка фонового шума и пауз, более надёжная работа в длительных сессиях, расшифровки и текст ответов, распознавание буквенно-цифровых данных и смещение распознавания в сторону заданных ключевых слов. 3
Голосовые сессии GPT‑Live‑1 стоят 0,05 доллара за минуту. Тарификация идёт посекундно: стоимость не округляется до полной минуты. 2
При этом это цена именно голосового слоя. Использование выбранной бэкенд-модели и инструментов оплачивается отдельно, поэтому итоговая стоимость зависит от того, какие модели и вызовы использует приложение. 2
В предоставленных материалах нет достаточных подтверждений деталей о корпоративном доступе «Presence», а также утверждения о расширенной поддержке конкретных акцентов, диалектов и языков.
По данным OpenAI, GPT‑Live‑1 показала улучшение на 30 процентных пунктов в Full Duplex Bench по сравнению с GPT‑Realtime‑2.1. В паре с GPT‑6 Astra при среднем уровне reasoning-модели она заняла первое место в Tau3. 3
Однако точные показатели задержки — от 1,41 до 0,798 секунды — и результаты Tau3 на уровне 86,2% против 45,7% в представленных источниках не приведены. Эти конкретные цифры следует считать неподтверждёнными на основании доступных материалов.
Сервис Yelp сообщил, что интеграция GPT‑Live‑1 в Yelp Host и Hatch улучшила смену реплик и точность по сравнению с прежней голосовой архитектурой. В звонках по бронированию столиков и заказу еды компания также отметила заметный рост доли успешно обработанных звонков и более полные, естественные реплики со стороны клиентов. 3
Платформа Speak, предназначенная для изучения языков, заявила, что модель даёт учащимся больше времени на обдумывание ответа до реакции виртуального преподавателя. По словам компании, число перебиваний сократилось почти на 80% относительно прежних систем с жёсткой очередностью реплик. 3
Сооснователь и технический директор одной компании из сферы здравоохранения сообщил, что замена каскадной реализации упростила кодовую базу на 80% и позволила удалить 23 000 строк кода, сделав общение с пациентами в реальном времени более естественным. 3
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
OpenAI объявила о запуске GPT‑Live‑1 в API 10 сентября 2026 года, а не 11 сентября.
OpenAI объявила о запуске GPT‑Live‑1 в API 10 сентября 2026 года, а не 11 сентября. Модель работает в full duplex режиме: она способна одновременно слушать собеседника и говорить, а не обрабатывать разговор строго по очереди.
GPT‑Live‑1 объединяет голосовой слой в одной модели; более сложные рассуждения и вызовы инструментов можно передать отдельной бэкенд модели.