“AI语音进入‘表演时代’。”阿里最新发布的Qwen-Audio-3.0-TTS重点突破细粒度情感控制,让合成语音能依据文本语境调节情绪,更像在“配音”而非机械朗读。
多语种、方言覆盖的扩展与声学鲁棒性的改进,则让语音生成在嘈杂等真实场景下保持稳定输出。
打开网易新闻 查看精彩图片
该模型的Plus版本已登顶全球权威语音合成榜单,把语音交互从“能说”推进到“会演”的新阶段。
“AI语音进入‘表演时代’。”阿里最新发布的Qwen-Audio-3.0-TTS重点突破细粒度情感控制,让合成语音能依据文本语境调节情绪,更像在“配音”而非机械朗读。
多语种、方言覆盖的扩展与声学鲁棒性的改进,则让语音生成在嘈杂等真实场景下保持稳定输出。
该模型的Plus版本已登顶全球权威语音合成榜单,把语音交互从“能说”推进到“会演”的新阶段。
热门跟贴