Adobe Firefly过去几年一直在学习生成图像和视频,现在它把目标对准了音频领域。近日,Firefly平台正式上线了Generate Music(生成音乐)、Generate Speech(生成语音)和Generate Sound Effects(生成音效)三项功能,创作者无需离开Adobe的AI工作区,就能完成音乐、旁白和自定义音效的制作。
据Adobe介绍,Generate Music可以生成完全授权、免版税的音乐曲目,而Generate Speech支持超过20种语言的语音。这意味着Firefly在视频制作流程中扮演的角色明显扩大——过去生成一段视频后,创作者往往需要切换到其他工具来完成音频部分,现在更多音频工作可以在同一个平台内完成。
三个工具各自能做什么
Generate Music可以根据文字描述构建器乐音轨,并提供风格、节奏等控制选项。它还能分析上传的视频内容,生成与画面更匹配的音乐。Generate Speech则负责旁白部分,将脚本转换为配音,支持调整语调和发音,Adobe称其支持20多种语言,这为制作同一视频的多语言版本提供了便利。Generate Sound Effects覆盖了前两者之外的细节音效,创作者可以用文字描述效果,也可以上传参考音频作为引导,包括用声音表演来塑造最终效果。
这三项功能合在一起,覆盖了以往创作者需要借助外部工具完成的大部分音频工作。
Adobe为什么要把音频放进Firefly
每多用一个工具,就多一次交接。音乐可能来自一个服务,旁白来自另一个,音效又来自别处。Adobe试图通过把更多工作流留在Firefly内部来减少这些绕路。对于已经在用Firefly处理图像或视频的创作者来说,这意味着更少的导出步骤,更少在应用之间来回切换的时间。
不过,便利性只能带来有限的价值。已经习惯使用专业音频工具的创作者,仍然需要一个理由来替换现有方案。
创作者接下来该关注什么
真正的考验在于,Firefly生成的音频能否持续保持足够好的质量,以支撑它承担更大的角色。一段音轨或配音即使符合提示词要求,一旦配上精良的视频,仍可能显得平庸或生硬。
Adobe已经明确了方向:Firefly正在深入视频制作流程,而音频功能给了创作者在生成第一张图像或第一段视频之后,继续留在平台内的又一个理由。
热门跟贴