OpenAI发布GPT-Live语音模型,首次实现全双工架构——AI可以一边听一边说,不再需要"等你说完"。该模型支持自然的打断、回应词、实时翻译,每周已有1.5亿用户使用ChatGPT语音功能。这标志着AI语音交互从"问答模式"进入"对话模式"。
"你有没有觉得,和AI对话总有一种'对讲机'的感觉?你说完,等它说,它说完等你说——完全没有真人聊天的流畅感?"
OpenAI终于解决了这个问题。2026年7月8日发布的GPT-Live采用全双工架构,让AI第一次真正学会了"对话"。
1. 全双工架构 不再是"你说完我再说"的轮流模式,而是真正的双向实时交互。AI会在你说话时发出"嗯"、"对"等回应词,保持对话的自然流畅。
2. 智能打断能力 AI可以在适当时候插入对话,也可以在被打断时优雅地暂停。这种能力让语音交互真正接近人类对话。
3. 多模态融合 对于需要深度思考或搜索的任务,GPT-Live会在后台调用GPT-5.5等前沿模型,同时保持对话流不中断。
"当AI学会了'插嘴',它就真的懂了对话的真谛。"