공식 API 발표일은 9월 11일이 아니라 2026년 9월 10일이다. [3] GPT‑Live‑1은 듣기와 말하기를 동시에 수행하는 풀 듀플렉스 음성 모델로, 보다 자연스러운 대화형 음성 에이전트를 목표로 한다. [3] 기존의 음성 인식(STT)·언어 모델·음성 합성(TTS) 연쇄 구조와 달리, 음성 상호작용을 하나의 모델에서 처리한다.
게시자GPT Image 2로 이미지 생성
연구 답변

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
오픈AI의 API 발표일은 질문에 언급된 2026년 9월 11일이 아니라 9월 10일이다. 오픈AI는 이날 개발자가 음성 앱과 업무용 워크플로를 만들 수 있도록 GPT‑Live‑1을 API에 출시했다고 밝혔다. 이 모델은 대화 중 동시에 듣고 말하는 ‘풀 듀플렉스(full-duplex)’ 방식으로, 음성 에이전트의 대화 흐름을 더 자연스럽게 만드는 데 초점을 맞췄다. 3
기존 음성 에이전트는 보통 다음 단계를 순서대로 거친다.
이처럼 여러 모델을 연결하는 방식은 단계마다 지연이 쌓일 수 있고, 말의 타이밍이나 맥락, 대화의 리듬이 일부 손실될 수 있다. GPT‑Live‑1은 듣기와 말하기를 하나의 음성 모델에서 결합해 처리한다는 것이 오픈AI의 설명이다. 3
그 결과 사용자가 말을 끊거나 짧게 호응할 때에도 이를 대화 중에 반영할 수 있다. 복잡한 추론이나 외부 도구 실행은 별도로 연결한 백엔드가 처리하는 구조다. 3
GPT‑Live‑1은 음성 상호작용 계층으로 작동하며, 더 깊은 추론과 작업 실행은 오픈AI의 GPT‑6 Astra 같은 백엔드 모델이나 타사 모델에 위임할 수 있다. 개발자는 업무 성격에 따라 추론 성능, 응답 속도, 비용을 조합할 수 있다. 3
오픈AI는 시스템 프롬프트로 말투, 속도, 대화 스타일을 제어할 수 있다고 설명했다. 또한 전화망 환경 배포, 배경 소음과 침묵 처리, 긴 세션의 안정성, 대화록·응답 텍스트 제공, 영숫자 인식, 특정 키워드 인식 편향 기능도 주요 기능으로 제시했다. 3
GPT‑Live‑1 음성 세션은 분당 0.05달러이며, 1분 단위 올림 없이 초 단위로 과금된다. 2
다만 이 가격은 음성 계층에 대한 비용이다. 세션 중 사용하는 백엔드 언어 모델과 도구 호출 비용은 별도 청구되므로, 실제 통화·세션 비용은 선택한 모델과 도구 사용량에 따라 달라진다. 2
오픈AI는 GPT‑Live‑1이 GPT‑Realtime‑2.1보다 Full Duplex Bench에서 30%포인트 향상됐다고 밝혔으며, GPT‑6 Astra를 중간 수준의 추론 설정으로 결합한 구성은 Tau3에서 1위를 기록했다고 설명했다. 3
초기 도입 기업들의 사례도 공개됐다. Yelp는 Yelp Host와 Hatch에 GPT‑Live‑1을 통합한 뒤 기존 음성 구조보다 발화 순서 처리와 정확도가 개선됐다고 전했다. 예약·음식 주문 전화에서 통화 처리율이 의미 있게 높아졌고, 이용자가 더 완전하고 자연스러운 문장으로 말하게 됐다는 설명이다. 3
언어 학습 서비스 Speak은 이전의 턴 기반 시스템보다 학습자가 답변을 생각할 시간을 더 확보할 수 있었고, 튜터의 끼어들기가 거의 80% 줄었다고 밝혔다. 한 헬스케어 기업의 공동창업자 겸 CTO는 연쇄형 구현을 대체하면서 코드베이스가 80% 단순화되고 코드 2만3,000줄을 없앴다고 말했다. 3
한편 제공된 근거만으로는 일부 자료에서 언급된 구체적인 지연 시간 수치나 Tau3 통과율 수치를 독립적으로 확인할 수 없다. 또한 관리형 ‘Presence’ 기업 접근 방식, 억양·방언·언어 지원 확대에 관한 구체적 주장도 이번 제공 자료만으로는 뒷받침되지 않는다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
공식 API 발표일은 9월 11일이 아니라 2026년 9월 10일이다. [3]
공식 API 발표일은 9월 11일이 아니라 2026년 9월 10일이다. [3] GPT‑Live‑1은 듣기와 말하기를 동시에 수행하는 풀 듀플렉스 음성 모델로, 보다 자연스러운 대화형 음성 에이전트를 목표로 한다. [3]
기존의 음성 인식(STT)·언어 모델·음성 합성(TTS) 연쇄 구조와 달리, 음성 상호작용을 하나의 모델에서 처리한다. [3]