OpenAIは2026年9月10日、GPT Live 1をAPIで一般提供開始した。モデルは聞くことと話すことを同時に行い、推論やツール利用は別のバックエンドへ委任できる。[1][16] 発話終了を待つ従来のターン制対話とは異なり、間、割り込み、相づち、会話の方向転換をリアルタイムに扱うことを目指している。[1][9][15] 音声レイヤーの料金は1分0.05ドルで秒単位課金。バックエンドモデルとツールの利用料は別途かかる。[16][18]
公開者GPT-5.6 Terra で編集GPT Image 2 で画像を生成
研究の答え

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT-Live-1 full-duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11. It introduced GPT‑Live‑1 as a generally available, full‑duplex voice layer: a model intended to make voice agents more natural by listening and spe. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
OpenAIは2026年9月10日、音声モデル「GPT-Live-1」をAPIで一般提供開始しました。発表日は9月11日ではありません。GPT-Live-1は、開発者が自然な会話型の音声エージェントを構築するためのモデルで、相手の音声を聞きながら話す「全二重(full-duplex)」の対話を特徴とします。1
16
従来の音声エージェントは一般に、音声を文字へ変換するSTT(speech-to-text)、応答を考える言語モデル、文字を音声化するTTS(text-to-speech)を連結する構成です。会話は「利用者が話し終える→システムが処理する→AIが話す」という区切られたターンで進みやすくなります。1
GPT-Live-1は、こうしたリアルタイム会話の前段を担う統合的な音声レイヤーとして位置付けられています。OpenAIによると、同モデルは聞くことと話すことを同時に行い、間の取り方や話す速さの変化を追い、その時点で返答すべきか、聞き続けるべきかを判断します。割り込みや短い相づち(バックチャネル)を、単なる入力エラーではなく会話の一部として扱いやすくする狙いです。1
9
15
GPT-Live-1がすべての処理を単独で担う必要はありません。音声での会話を継続しつつ、より時間のかかる推論、情報検索、業務ワークフロー、ツール呼び出しをバックエンドのモデルやエージェントに任せられます。
OpenAIは、OpenAIモデルへ処理を渡す「Responses delegation」と、開発者自身のバックエンドにつなぐ「client delegation」をサポートしています。16 ChatGPT Businessのリリースノートでは、難しい検索・推論に使う選択肢としてGPT-6 Astraも挙げられています。
4
構成を分けると、役割はおおむね次のようになります。
APIリリースでは、指示追従性の向上、カスタムボイス、電話回線との連携(テレフォニー)も案内されています。13
GPT-Live-1の音声セッション料金は1分あたり0.05ドルです。請求は秒単位で、次の1分へ切り上げられることはありません。16
18
ただし、これはあくまで音声セッションの料金です。バックエンドで使うモデルの推論コストや、ツールの利用料は別途請求されます。そのため本番運用の予算では、通話・会話時間に加え、委任先でどのモデルやツールをどの程度使うかも見積もる必要があります。16
18
OpenAIは、GPT-Live-1がGPT-Realtime-2.1と比べて「Full Duplex Bench」で30ポイント改善したと説明しています。また、GPT-Live-1とGPT-6 Astraを中程度の推論設定で組み合わせた構成が、Tau3で首位になったとしています。1
一方、今回提供された資料だけでは、質問に含まれるターンテイキング遅延の具体的な数値や、Tau3における正確な通過率の比較は独立して確認できません。これらの数値は、現時点では検証済みの事実として扱わないのが適切です。
OpenAIは、より自然なターンテイキングの効果を示す例として、複数の導入事例を紹介しています。
これらは各社が報告した導入結果であり、独立評価による普遍的な性能保証ではありません。用途、会話設計、委任先モデル、運用条件によって成果は変わります。
提供資料では、管理製品「Presence」を通じた企業向けアクセスに関する主張は裏付けられていません。また、このAPIリリースに伴うアクセント、方言、対応言語の具体的な拡大についても確認できません。調達や実装の判断に用いる場合は、最新のOpenAI公式ドキュメントを直接確認する必要があります。
GPT-Live-1の要点は、音声会話を担う全二重レイヤーと、推論・ツール実行を担うバックエンドを分けられるアーキテクチャにあります。会話中も聞き続け、必要に応じて話し、裏側では別システムが時間のかかる処理を進められます。音声レイヤーは1分0.05ドル、秒単位課金ですが、実際のエージェントの総コストはバックエンドモデルとツールの利用状況を含めて評価する必要があります。1
16
18
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
OpenAIは2026年9月10日、GPT Live 1をAPIで一般提供開始した。モデルは聞くことと話すことを同時に行い、推論やツール利用は別のバックエンドへ委任できる。[1][16]
OpenAIは2026年9月10日、GPT Live 1をAPIで一般提供開始した。モデルは聞くことと話すことを同時に行い、推論やツール利用は別のバックエンドへ委任できる。[1][16] 発話終了を待つ従来のターン制対話とは異なり、間、割り込み、相づち、会話の方向転換をリアルタイムに扱うことを目指している。[1][9][15]
音声レイヤーの料金は1分0.05ドルで秒単位課金。バックエンドモデルとツールの利用料は別途かかる。[16][18]