打开网易新闻 查看精彩图片

AI音乐生成平台Suno于10月2日正式推出全新"Speech"(语音)功能,首次将AI语音合成与音乐生成整合至同一轨道中。该功能目前已在Suno网页端和移动端同步开启公测,用户可在创作界面中选择该选项,体验文字转语音与配乐一体化生成。

新功能提供"简易"与"高级"两种模式。在简易模式下,用户可通过提示词描述所需内容,例如输入"一位海盗船长鼓舞船员"的指令,系统将自动生成对应风格的声音与背景音乐;高级模式则支持用户输入自定义脚本,并对AI语音的性别、说话风格以及语音变化程度进行精细调整。Suno强调,该功能单次生成时长上限约为8分钟,同时提供背景音乐开关,用户可选择仅生成纯净人声。

Suno首席产品官Jack Brody在公告中称,语音功能是Suno对"人类多元表达形式"的一次拓展,公司将继续根据用户反馈优化产品细节。他同时坦言该功能仍处于测试阶段,"英国口音有时会漂移到澳大利亚,戏剧性停顿也可能过于夸张",并鼓励用户探索团队未曾设想的应用场景。

值得留意的是,AI语音生成领域并非新兴赛道——DeepMind在该领域已有十年研究积累,Adobe也推出过文本转语音工具,ElevenLabs自2023年上线后已成为业内最具辨识度的平台之一。Suno此时入局,被外界视为在音乐生成器面临多起版权诉讼的背景下推动业务多元化的举措。

参考链接:
https://www.theverge.com/ai-artificial-intelligence/1003925/suno-speech-ai-voice-feature-beta-availability