阿里巴巴发布实时语音对话模型 Qwen-Audio-3.0-Realtime,分为强调推理能力的 Plus 版本和强调响应速度的 Flash 版本。模型支持动态工具调用、音色克隆、多人说话识别和双工对话,可用于客服、教育、娱乐互动和语音助手。 阿里称,新模型能够在嘈杂环境中过滤背景说话声,并根据语境 本文链接