OpenAI 的 GPT‑Live‑1 API 公告日期是 2026 年 9 月 10 日,而唔係 9 月 11 日。 GPT‑Live‑1 屬全雙工語音模型,可同時聆聽及說話,而非等用戶講完先逐步處理。 模型可即時應對插嘴和簡短回應;較深度的推理及工具操作可交由後端模型處理。
發布者圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce on September 11, 2026, about launching the GPT Live 1 full duplex voice model in its API, including how it differs. Article summary: OpenAI’s API announcement was dated September 10, 2026—not September 11.. Topic tags: general web, openai, chatgpt, prompt engineering, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidenc
OpenAI 的 API 發布公告日期其實係 2026 年 9 月 10 日,唔係 9 月 11 日。公司當日宣布在 API 推出已正式可用的 GPT‑Live‑1:一個全雙工(full-duplex)語音層,目標係令語音代理的對話更接近真人——可以一邊聽、一邊講,而唔係將交流切成一輪輪「你講完、我先答」的回合。3
傳統語音代理一般會串連三個步驟:語音轉文字(speech-to-text)、語言/推理模型、文字轉語音(text-to-speech)。每一次轉交都會增加延遲,亦可能令語氣、時間節奏及對話脈絡流失。GPT‑Live‑1 則把聆聽和說話整合在同一個語音模型內。3
實際效果係,系統可以在說話期間繼續聽用戶反應,較自然地處理插嘴、附和或改口;與此同時,需要較深入推理或使用工具的工作,則可交由配對的後端處理。3
開發者可選用 OpenAI 後端模型,例如 GPT‑6 Astra,亦可接駁第三方模型,按個別工作取捨推理能力、速度和成本。3
OpenAI 強調,GPT‑Live‑1 提供 system prompt 控制,讓開發者調整說話語氣、節奏及對話風格。其餘重點包括電話系統部署、背景雜音及靜音處理、較長 session 的穩定性、逐字稿及回應文字輸出、英數字元辨識,以及關鍵字偏向設定。3
GPT‑Live‑1 的語音 session 收費為 每分鐘 0.05 美元,按秒計費,不會每次通話都向上湊整至完整一分鐘。2
不過,呢個價錢只涵蓋語音層;後端模型的用量和工具調用會另外收費。因此,實際成本會是語音 session 費用,加上所選模型及工具的使用費。2
現有資料未足以證實所謂受管「Presence」企業存取安排,亦未能支持關於新增口音、方言及語言覆蓋的具體說法。
OpenAI 表示,GPT‑Live‑1 在 Full Duplex Bench 較 GPT‑Realtime‑2.1 高出 30 個百分點;配合 GPT‑6 Astra、使用中等推理力度時,則在 Tau3 排名第一。3
至於曾流傳的 1.41 秒對 0.798 秒延遲,以及 Tau3 86.2% 對 45.7% 通過率等確切數字,所提供資料並無獨立展示,故不宜視為已核實數據。
早期採用者方面,Yelp 表示,將 GPT‑Live‑1 整合至 Yelp Host 和 Hatch 後,輪流說話的表現及準確度較舊有語音架構有所改善;在訂位及食物訂購來電中,來電處理率有明顯進步,用戶亦較常以完整、自然的句子說明需要。3
語言學習平台 Speak 表示,相較舊有按回合運作的系統,GPT‑Live‑1 令學習者有更多時間思考才收到導師回應,打斷情況減少近八成。3
另有一家醫療公司的聯合創辦人兼 CTO 指,改用 GPT‑Live‑1 取代串接式架構後,程式碼庫簡化了八成、刪除 23,000 行程式碼,亦有助提供更自然的即時病人對話。3
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
OpenAI 的 GPT‑Live‑1 API 公告日期是 2026 年 9 月 10 日,而唔係 9 月 11 日。
OpenAI 的 GPT‑Live‑1 API 公告日期是 2026 年 9 月 10 日,而唔係 9 月 11 日。 GPT‑Live‑1 屬全雙工語音模型,可同時聆聽及說話,而非等用戶講完先逐步處理。
模型可即時應對插嘴和簡短回應;較深度的推理及工具操作可交由後端模型處理。