模型 / 官方
OpenAI 推出新一代语音模型 GPT-Live,主打更自然的人机对话
OpenAI 正式发布新一代语音模型 GPT-Live,并已在 ChatGPT Voice 中默认启用。官方介绍显示,新模型针对自然人机交互场景进行重新设计,重点改进语音的节奏感、停顿与情绪表现,让对话听感更接近真人。它将替代此前的语音后端,覆盖实时对话、语音问答等场景。
OpenAI 正式推出新一代语音模型 GPT-Live,定位为面向自然人机交互的下一代语音系统。官方在介绍中将其描述为 ChatGPT Voice 的新一代动力引擎,意味着用户很快就会在默认语音模式下体验到升级效果。
相比此前的语音方案,GPT-Live 的核心改进集中在拟人化表达上,包括更自然的停顿、语速变化以及情绪色彩。OpenAI 希望借助这些细节,让 AI 语音从过去的逐句生成,更接近一段连贯的真人对话。
在产品层面,GPT-Live 已经在 ChatGPT Voice 中默认开启。用户无需额外设置,只要继续使用语音模式即可体验;同时它也会逐步覆盖移动端与桌面端,确保不同设备上的体验一致。
OpenAI 选择把语音能力作为单独一代模型发布,说明语音交互正在成为 ChatGPT 的主流形态之一。对于依赖语音回答、实时翻译或语音智能体的用户来说,新模型有望显著提升流畅度和耐听度。
随着 GPT-Live 上线,OpenAI 也为开发者后续推出音频类应用打下基础。可以预见,未来基于 ChatGPT 的语音助手、客服、陪聊等场景将更容易实现接近真人的对话体验。
要点
- GPT-Live 是 OpenAI 新一代语音生成模型,已在 ChatGPT Voice 中启用。
- 新模型重点优化节奏、停顿与情绪表达,强调更自然的拟人感。
- 用户无需操作,默认语音模式即可自动切换到新模型。
- 覆盖移动端与桌面端,逐步替换旧版语音后端。
- 为后续 AI 语音助手、实时对话类应用提供更接近真人的体验。