谷歌把AI音乐生成直接塞进了Gemini应用里。这次的主角是全新的Lyria 3.5模型,用户不用再跳转到独立工具,在聊天界面里就能直接生成带人声的完整歌曲。
按照谷歌的说法,Lyria 3.5相比上一代,在人声表现力和编曲丰富度上都有明显提升。用户可以在Gemini里选流派和风格,决定要纯音乐还是带人声,也能生成短片段或完整长度的曲目。为了降低上手门槛,谷歌还内置了背景音乐和个性化生日歌的模板,新手点开就能用。
不止Gemini,一口气铺了四个入口
这次发布不是单点更新。除了Gemini应用,Lyria 3.5还同步登陆了Google Flow Music(带额外功能)、Google AI Studio(面向开发者)以及Google Vids。四个入口同时开放,覆盖了普通用户、创作者和开发者三类人群,谷歌这次显然是想把AI音乐生成做成平台级能力,而不是一个孤立的小功能。
对开发者来说,Google AI Studio的开放意味着可以调用API做二次开发。对普通用户来说,最直观的变化就是:以前要专门打开一个音乐生成工具,现在在Gemini里顺嘴说一句"帮我做一首电子风格的生日歌",就能直接出成品。
训练数据这块,谷歌和Suno划清了界限
有意思的是,谷歌在发布里特意强调了一件事:Lyria模型只用了获得授权的内容进行训练,并且直接点名对比了Suno的音乐模型。这句话的潜台词很明显——在AI音乐版权争议愈演愈烈的当下,谷歌想把自己放在"合规"这一边。
不过,谷歌并没有透露实际使用的训练数据具体是什么。也就是说,"只用授权内容"这个说法目前没有更多细节支撑,具体用了哪些数据源、授权范围有多大,外界依然不清楚。在AI音乐版权官司频发的背景下,这个表态能起到多大作用,还有待观察。
AI音乐生成,竞争已经白热化
谷歌这次的动作,其实是在回应一个已经非常拥挤的市场。Suno和Udio在去年就凭借高质量的音乐生成能力火了一轮,Meta也在今年年初开源了自家的音频生成模型。谷歌虽然有技术积累,但在产品落地和用户获取上,并不占先发优势。
把Lyria 3.5直接放进Gemini,是谷歌打出的差异化牌——不做一个独立的音乐App,而是把能力嵌入到已有的AI助手生态里。用户不需要额外下载工具,也不用学习新界面,在对话流里就能完成创作。这个思路和谷歌把Gemini嵌入搜索、文档、邮件的逻辑一脉相承。
对普通用户来说,门槛确实降低了。但对音乐行业来说,AI生成内容的版权问题依然是悬在头上的剑。谷歌强调"只用授权内容",某种程度上也是在给行业一个信号:这条路可以走通,但得按规矩来。
至于Lyria 3.5的实际生成质量到底如何,人声是否真的比上一代更自然,还需要实际体验才能判断。谷歌的官方描述向来乐观,真实水平要等用户上手之后才有答案。
热门跟贴