此后,代码和界面元素相继在网页版和移动版 ChatGPT 客户端中被发现。2026 年 6 月下旬,小部分用户开始收到有限测试,到 6 月 22–24 日,多个用户报告和演示视频已展示该模型在实际场景中的双向工作效果。
目前 ChatGPT 的语音模式(标准语音和高级语音模式)都采用轮流对话范式:模型必须等用户说完才能开始回应。而 GPT-Bidi-1 的双向(BiDi)架构则允许模型同时处理两路音频流:用户的声音和它自己的声音。
根据演示报告,其主要行为差异包括:
| 等级 | 说明 |
|---|---|
| High(高) | 最大推理深度,响应较慢——适合复杂分析任务 |
| Medium(中) | 智能与速度之间的平衡选择 |
| Instant(即时) | 最快响应速度,推理能力降低——适合休闲或时间敏感场景 |
这套等级系统让用户可以根据具体任务在交互深度与响应延迟之间做取舍,类似于 ChatGPT 文本模型提供的不同推理级别。 例如,查询天气或时间可用 Instant 模式,而进行深度头脑风暴则可切换至 High 模式。
当选中 GPT-Bidi-1 时,语音气泡/波形指示器会变为黄色,取代当前的默认颜色。 该模型在设置的模型选择器中作为一个新的选项出现,标签为 “Bidi(最新)”,与现有的标准语音和高级语音模式并列存在,而非取代它们。
gpt-bidi-1 的代码引用。