OpenAI 发布 GPT-Live 语音模型:ChatGPT 语音功能迎来「豆包式」进化

OpenAI 发布 GPT-Live 语音模型

7月9日,OpenAI 正式推出了全新一代语音模型 GPT-Live。据官方透露,目前每周有超过 1.5 亿人使用 ChatGPT 的语音和听写功能来练习外语、讲睡前故事或在通勤时打发时间。GPT-Live 的发布,让这些用户的语音交互体验迎来了一次质的飞跃——ChatGPT 的语音功能彻底「活」了过来。

GPT-Live 在语音识别的准确率、响应速度、自然度方面均有显著提升。与上一代相比,新模型能够更精准地理解用户的语气、停顿和情感变化,并据此调整回答的语气和节奏。这意味着用户与 ChatGPT 的对话将更加流畅自然,更像是在与真人交谈。

在功能层面,GPT-Live 支持多轮对话中的上下文保持,不再需要每次重新说明背景。同时,新模型在嘈杂环境下的语音识别能力也大幅增强,能够在咖啡厅、地铁等场景中保持较高的准确率。

来源:AITNT News

发表评论