语音AI正在从“说完一句再等回答”走向更像真人的连续交流。OpenAI介绍,GPT-Live是在六个月内搭建的实时语音系统,目标是让用户与AI进行持续语音互动。它采用“无轮次”的语音模型和低延迟架构,减少传统语音助手中录音、识别、等待模型回复、再合成语音的割裂感,让对话更快、更自然。和常见语音产品相比,GPT-Live的核心差异不是单纯把文本聊天接上麦克风,而是围绕实时听说重新设计交互方式:用户说话时系统可持续理解上下文,不必严格等待一方结束发言再进入下一轮。这种设计更接近电话沟通、客服问答、口语练习和车载助手等场景中人们的实际说话方式,也对模型响应、音频处理和系统调度提出更高要求。OpenAI强调的“六个月”显示,语音交互已成为大模型产品化竞争中的重点方向,速度、自然度和打断处理能力会直接影响用户是否愿意把A…
来源:OpenAI
原始发布时间:2026年8月3日 07:00