Suno在社交平台宣布,Speech功能正式进入Beta测试阶段。官方给出的定位很直接:这是第一个能生成带匹配背景音乐的语音音频的模型。

用户需要更新应用才能体验最新版本。官方同时附上了一篇博客文章,供想了解更多的人查看详情。

打开网易新闻 查看精彩图片

语音和音乐一起生成

过去做一段带配乐的语音内容,流程通常是分开的:先录或生成人声,再单独找音乐、调音量、对齐节奏。Suno这次把两件事合到了一步——生成语音的同时,背景音乐一并匹配出来。

官方强调的关键词是"matching",也就是音乐不是随便贴上去的,而是和语音内容相配。这一点如果成立,省掉的是后期反复试配乐的环节。

Beta意味着什么

功能被标注为Beta,说明它还在测试阶段,能力和稳定性都未定型。官方没有公布具体的语言支持范围、时长限制或商用条款。

从产品路径看,Suno此前以音乐生成被外界熟知,这次把能力延伸到语音加配乐的组合场景,等于在同一个生成管线里覆盖了更多内容形态。

对做播客、短视频旁白、有声内容的人来说,这类工具的价值在于把"人声"和"氛围"两个原本割裂的步骤合并。至于实际效果能否达到官方描述的水平,还要等Beta阶段的用户反馈。