谷歌今天(9月5日)发布公告,正式在 Gemini 应用和 Gemini API 中上线最新音乐生成模型 Lyria 3.5。这标志着谷歌的音乐 AI 从内部实验工具(Google Flow Music)正式走向主流用户与开发者生态。
两种模型,两种玩法
打开网易新闻 查看精彩图片
这次开放的模型分两档:Lyria 3 Clip(模型 ID 为 lyria-3-clip-preview)始终生成用于循环和预览的 30 秒片段;而 Lyria 3.5(模型 ID 为 lyria-3.5)则能生成包含数段副歌、桥段等,时长数分钟的完整歌曲。换句话说,想要快速试听用前者,想要成品级作品用后者。
视觉也能当灵感
除了文本提示,开发者还可以同时提供最多 10 张图像,模型会依据视觉内容来创作音乐。两种模型默认输出 MP3 音频,Lyria 3.5 还额外支持 WAV 格式输出。目前官网文档暂未发现定价相关信息。
水印防抄袭
所有生成内容均通过 Interactions API 统一调度,并嵌入 SynthID 隐形水印。这个水印能抵抗压缩、重采样等常见音频处理,主要用于版权追踪与内容溯源——对创作者来说,这算是一颗定心丸。
对开发者而言,Lyria 3.5 已同步开放调用接口,可通过 Google AI Studio、Vertex AI 及 Gemini API 接入。从 30 秒片段到数分钟完整歌曲,谷歌这次把音乐生成的自由度又往前推了一步。
热门跟贴