오픈AI가 2026년 7월 8일, 완전 양방향(full duplex) 아키텍처 기반의 차세대 음성 모델 GPT Live 1과 GPT Live 1 mini를 전 세계 출시했습니다. 이 모델들은 동시에 듣고 말할 수 있어 사용자가 말을 끊거나 잠시 멈춰도 자연스럽게 대응하며, ‘어’, ‘응’ 같은 감탄사로 청취 신호를 보냅니다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What is OpenAI's new GPT-Live-1 and GPT-Live-1 mini, how do their full-duplex voice capabilities. Article summary: Here is the complete fact-checked rundown.. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026년 7월 8일, 오픈AI는 GPT-Live라는 새로운 음성 모델군을 출시했습니다. 이는 AI 어시스턴트와의 상호작용 방식을 근본적으로 바꾸는 모델입니다. 기존 음성 어시스턴트가 '내가 말하면, 네가 말하는' 방식이었다면, GPT-Live-1과 GPT-Live-1 mini는 완전 양방향(full-duplex) 아키텍처를 기반으로 동시에 듣고 말할 수 있습니다ROA.
이 글에서는 이 모델들이 무엇을 할 수 있는지, 기존 방식보다 무엇이 좋아졌는지, 누가 개발했는지, 그리고 이번 주 AI 업계의 주요 소식들을 함께 정리합니다.
두 모델 모두 기존 챗GPT 어드밴스드 보이스 모드(Advanced Voice Mode)를 대체합니다. 기존의 반이중(half-duplex) 방식(모델이 말을 끝내야 사용자의 말을 들을 수 있음)과 달리, 들어오는 오디오를 지속적으로 처리하면서 동시에 음성 응답을 생성합니다HAT.
오픈AI는 추론 비용이 충분히 낮아져 무료 사용자에게도 이 모델을 제공할 수 있게 됐다고 밝혔습니다A. 출시 당시 GPT-Live는 백그라운드에서 GPT-5.5를 사용해 추론을 수행합니다OH.
완전 양방향 기능은 세 가지 측면에서 AI 음성의 느낌을 바꿔줍니다.
이 모델은 사용자가 중간에 말을 끊으면 멈추고 듣습니다. 사용자가 말하기를 망설이며 잠시 멈추면 끼어들지 않고 기다려 줍니다AT. 오픈AI의 프로덕트 리드 애티 엘레티(Atty Eleti) 는 출시 브리핑에서 "이것은 완전 양방향 모델"이라고 말했습니다T.
또한 사용자가 말하는 동안 '음', '응' 같은 소리로 듣고 있다는 신호를 보내거나, 생각할 시간이 필요할 때는 조용히 있어 줍니다OB.
GPT-Live가 어려운 질문을 받으면, 추론을 오픈AI의 최신 텍스트 모델(GPT-5.5 등)에 병렬로 위임합니다. 이 과정에서 GPT-Live 자체는 계속 사용자와 대화합니다AT. 연구 리드 쿤단 쿠마르(Kundan Kumar) 는 "GPT-Live가 질문에 대해 깊이 생각해야 할 때, 추론과 복잡한 작업을 GPT-5.5에 병렬로 위임하는 동안 GPT-Live는 계속 사용자와 대화한다"고 설명했습니다LT. 따라서 사용자는 음성 모델이 복잡한 작업을 추론할 때까지 기다릴 필요가 없습니다T.
GPT-Live는 대화 중 화면에 이미지, 다이어그램 등 AI 생성 콘텐츠를 보여줄 수 있습니다. 이는 순수 음성 채팅을 넘어선 멀티모달 경험을 제공합니다HAT. 더 버지(The Verge)는 이 모델이 날씨, 주식, 스포츠 대화를 AI 생성 이미지로 보완할 것이라고 보도했습니다T.
종합적으로, 이러한 기능들은 대화를 실제 사람과의 대화처럼 느끼게 만듭니다. 비즈니스 인사이더(Business Insider)는 이를 "당신이 말을 끊기 원하는 어시스턴트"라고 표현했고B, 더 버지는 "침묵을 더 잘 지키는" 모델이라고 평가했습니다T.
프레스 브리핑과 언론 보도에서 언급된 주요 인물은 두 명입니다.
2026년 1월 보도에 따르면, 인프라 리드 벤 뉴하우스(Ben Newhouse) 와 프로덕트 매니저 재키 섀넌(Jackie Shannon) 도 오디오 AI 개편에 참여했습니다IX.
gpt-realtime-2.1 및 gpt-realtime-2.1-mini)도 출시했습니다. 이 모델들은 개선된 캐싱을 통해 p95 지연 시간을 25% 줄였습니다C.출시 당시 한 가지 제한 사항은 GPT-Live가 현재 비디오 기능을 지원하지 않는다는 점입니다T.
오픈AI의 GPT-Live 출시는 AI 업계가 유난히 바빴던 한 주의 중간에 이루어졌습니다.
오픈AI 생태계:
경쟁사 및 관련 소식:
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
오픈AI가 2026년 7월 8일, 완전 양방향(full duplex) 아키텍처 기반의 차세대 음성 모델 GPT Live 1과 GPT Live 1 mini를 전 세계 출시했습니다.
오픈AI가 2026년 7월 8일, 완전 양방향(full duplex) 아키텍처 기반의 차세대 음성 모델 GPT Live 1과 GPT Live 1 mini를 전 세계 출시했습니다. 이 모델들은 동시에 듣고 말할 수 있어 사용자가 말을 끊거나 잠시 멈춰도 자연스럽게 대응하며, ‘어’, ‘응’ 같은 감탄사로 청취 신호를 보냅니다.
복잡한 질문은 GPT 5.5에 병렬로 전달해 추론하며, 대화 중 주식, 날씨, 스포츠 관련 AI 생성 이미지를 화면에 띄워 보여줍니다.