做视频的人最近可能注意到一个变化:Runway的模型列表里,多了一个专门管声音的选项。ElevenLabs v4已经正式上线Runway平台,和图像、视频模型放在一起调用。

这次上线的v4模型,主打的是旁白和角色对白两个场景。官方给出的说法是,它在表现力和语调自然度上比以往版本更强。换句话说,过去AI配音那种平铺直叙的念稿感,v4想再往前推一步。

打开网易新闻 查看精彩图片

声音和画面被放进同一个工作台

Runway本身以图像和视频生成能力被创作者熟悉,这次把ElevenLabs v4接进来,意味着一条视频里的画面和声音可以在同一个平台内完成。对于习惯在多个工具之间来回导出的创作者来说,少一次切换就少一道工序。

官方在发布信息里提到,v4是"和世界上最好的图像、视频模型一起"提供的。这句话的潜台词是,声音不再是视频制作流程里被单独拎出去处理的一环,而是和画面平级的基础能力。

旁白和对白,是两个不同的难题

旁白要求稳定、连贯、情绪克制,角色对白则要求语气有起伏、能贴合人物性格。ElevenLabs把v4的强项明确指向这两类任务,说明它瞄准的不是简单的"把文字读出来",而是需要表演感的声音内容。

表现力和语调自然度这两个指标,恰恰是过去AI语音最容易被听出来的破绽所在。v4能不能让听众不再第一时间意识到"这是AI",取决于这两项的实际表现。

目前该模型已在Runway上线,官方附上了试用链接。对于需要大量配音内容的视频创作者,这是一个可以直接上手测试的新选项。