技术

GPT-Live为ChatGPT带来全双工语音——那个暴露AI身份的停顿消失了

Adrian Kessler

2026年7月10日,OpenAI以GPT-Live取代了基于轮流机制的Advanced Voice Mode,自动将每周1.5亿语音用户迁移至同步处理架构——无需选择加入,也未公布停用日期。

每次与ChatGPT进行语音交流结束时都有一个熟悉的信号:模型完成处理、生成回复,然后才将发言权交还给你。这种被称为”轮流制”的节奏,自最初商业部署以来就定义了大多数语音AI的运作方式。OpenAI用GPT-Live将其彻底替代。

GPT-Live基于全双工架构运行,能够在处理传入语音的同时生成回复。2026年7月10日,OpenAI向Go、Plus和Pro付费用户推出了GPT-Live-1,向免费用户推出了GPT-Live-1 mini——两者均无需选择加入,在全球范围内取代了Advanced Voice Mode。

实际变化在于:你可以在模型说话途中插话,它会停下来。GPT-Live能够接收简短的应声、问题或话题转换,无需任何一方先完成自己的发言。它可以用一句简短的”嗯”或”好的”来表示在听,或者在对方还在思考时保持沉默,直到想法成形。当对话需要网络搜索、深度推理或复杂任务时,GPT-Live会悄悄将工作交给后台的前沿模型,并将结果带回实时对话中。

全双工架构并不意味着GPT-Live在理解你说的内容上变得更好——它意味着模型能更自然地响应对话的节奏。这一区别至关重要。早期用户报告了一个由模型自身积极性引发的规律:在长篇密集的解释中,GPT-Live有时会在处理完整含义之前就认可一个说法。部分用户认为这些应声过于殷勤。该系统完全在OpenAI的服务器上运行,因此每次语音对话都依赖于低延迟连接,而并非所有1.5亿周活用户都能获得同等的网络条件。基础设施较慢的地区可能会发现GPT-Live的实时目标超出了底层网络的实际能力。

OpenAI未经同意就将所有语音活跃用户迁移至新系统。公司将GPT-Live定位为升级——而全双工的转变确实在对话流畅性上实现了真正的提升。但这同时也改变了数百万用户据以校准预期的交互模式,且未公布旧系统的停用日期。

目前没有针对现有ChatGPT订阅者的价格调整公告。面向开发者和企业的API部署已在计划中,早期访问注册现已开放。OpenAI尚未确认Advanced Voice Mode的正式停用日期。

标签: , , , , ,

讨论

有 0 条评论。