OpenAI于7月8日发布GPT-Live-1和GPT-Live-1 mini,并开始在ChatGPT全球部署。两款模型支持全双工交互,系统可以一边说话一边继续聆听,并在被打断时作出反应,不必把每轮交流限制在严格的一问一答模式。

OpenAI称,语音系统可把搜索、推理和其他复杂工作交给GPT-5.5,同时维持对话。这样的分工让实时模型处理时机和语音,另一款模型负责更重的任务。交接能否保留语境、说明延迟并避免盖过用户讲话,仍是运营层面的问题,不是发布公告已经解决的结论。

API访问被安排在之后,并未随首批消费者版本一同广泛开放。开发者应把ChatGPT的部署和未来可编程访问区分开来。计划资格、支持语言和地区可用性也可能变化,需要在当前发布说明中确认。

7月31日的更新为符合条件的生成音频加入SynthID支持,同时提供公开和API验证渠道。这一功能晚于最初发布,应该被描述为后续的来源标记更新,而不是从第一天起所有音频都必然具备的功能。

关键检验不是演示听起来是否像真人。持续聆听的助手需要从打断中恢复,在合适时刻保持安静,处理背景语音,并在翻译时保留含义。TechCrunch指出一次演示中的印地语不够自然,但单一例子不是多语言评估,也不能支撑广泛的质量排名。

接下来值得关注

OpenAI的API发布、计划矩阵、支持语言清单,以及外部的打断和翻译测试,将显示新语音系统的实际适用范围。

信息来源

这份回顾性发布档案于2026年8月3日根据OpenAI公告和发布说明整理,并以TechCrunch报道补充发布背景。AI News of Today未进行语音或语言测试。

我们尽可能链接原始文件,并采用一手采访资料。

  1. OpenAI GPT-Live announcement原始来源 · 2026年7月8日
  2. TechCrunch launch coverage媒体报道 · 2026年7月8日 17:00 UTC
  3. ChatGPT release notes原始来源 · 2026年7月31日