Qwen-Audio-3.0-Realtime 发布:千问实时语音模型兼顾毫秒响应与推理深度

千问宣布正式发布实时语音交互对话模型 Qwen-Audio-3.0-Realtime,号称「既要毫秒级响应、又不牺牲推理深度」的实时语音模型。

公告称,该模型在智商、Agent 工具调用、共情对话、双工交互流畅度四个维度均有显著提升。这意味着开发者可以在语音助手、智能客服、语音交互游戏等场景中,获得更自然流畅的实时语音对话体验,同时保留大模型在复杂推理任务上的能力。

同期,小米开源了 Xiaomi-Robotics-U0——一个拥有 380 亿参数的多模态自回归具身生成基础模型,号称具身领域首个「通吃」四类任务的统一生成模型,进一步推动具身智能开源生态发展。

来源:OSCHINA

发表评论