全雙工能力喺三個具體方面改變咗語音 AI 嘅感覺,OpenAI 喺發布會上都有示範。
模型可以喺你講到一半嘅時候俾你打斷,佢會即刻收聲同聽你講,而唔係繼續講落去。佢亦識得檢測到你諗緊嘢而停頓,會等你唔會搶住講 AT。OpenAI 產品總監 Atty Eleti 喺發布會話:「呢個係一個全雙工模型」 T。
當 GPT-Live 遇到難答嘅問題,佢會將推理工作分流俾 OpenAI 最新嘅文字模型(例如 GPT-5.5),同時間自己繼續同用戶保持對話 AT。研究主管 Kundan Kumar 解釋:「當 GPT-Live 需要認真思考一個問題,佢可以將推理同複雜任務分流俾 GPT-5.5,而自己就繼續同用戶傾偈」 LT。咁樣用戶就唔需要等語音模型慢慢諗嘢——從研究到講出結果嘅過程幾乎係即時 T。
GPT-Live 可以喺對話期間即時生成圖像、圖表或者其他 AI 內容,令對話唔再局限於純語音,變成多媒體體驗 HAT。《The Verge》報道,講天氣、股票、體育嗰陣,模型會自動生成圖像輔助說明 T。
喺發布會同媒體報道入面提到嘅兩位關鍵人物:
不過要注意:推出初期,GPT-Live 暫時唔支援語音加視頻功能 T。
OpenAI 推出 GPT-Live 嘅呢個星期,AI 界非常熱鬧。
OpenAI 自己嘅生態系:
競爭對手同相關消息: