你敢信吗,AI大厂训大模型,居然直接跑到盗版网站薅创作者的免费羊毛,这回直接被整个音乐圈堵到法院门口了。当地时间8月28日,索尼旗下索尼音乐出版、华纳旗下华纳查佩尔音乐带头,联合一共35家版权方,正式把AI圈顶流Anthropic告到了美国加州联邦地区法院,连两位核心创始人都被列为个人被告。这可不是小打小闹的官司,背后牵扯的金额说出来能吓你一跳。

打开网易新闻 查看精彩图片

原告这边明确指控,Anthropic没拿到任何授权,就私自抓取了几万首有版权的歌词、乐谱,全都用来训练自家的Claude生成式AI,已经构成了严重的著作权侵权。按照原告的要求,法院得判令Anthropic把所有非法复制的版权作品副本全部销毁。按照美国版权法的规定,故意侵权的话,单部作品最高就能索赔15万美元。本案涉及整整几万首音乐作品,真要是全都按上限赔,理论上赔偿金额能到几十亿美元,这数字谁看了不迷糊。

诉状把Anthropic偷素材的过程扒得明明白白。2021到2022年这两年,Anthropic用BT下载工具,从盗版影子图书馆弄来了超过700万册各类资料,一股脑全塞进了自己的AI训练数据集。这批资料里,就夹杂了大量受版权保护的歌词和乐谱内容,全都是没拿到授权的黑货。除了盗版仓库的货,Anthropic还直接爬取各个公开歌词网站上的音乐文本,啥授权都没要,直接拿来训模型。

原告说了,这种批量从盗版渠道获取侵权资料的操作,就是两位创始人阿莫代伊和曼授意批准的。所以不光公司要担责任,两个核心决策者也得承担个人层面的法律责任。这波操作摆明了就是不想只拿公司开刀,要把违法成本拉到最高,给整个行业提个醒。

这其实不是Anthropic第一次在版权问题上翻大车。之前他们就因为用盗版书籍训练AI,被一大批作家集体起诉,最后赔了15亿美元才达成和解,这个金额至今还是美国AI版权和解的最高纪录。当时法院就给出了明确说法,哪怕AI模型训练本身有可能被认定为合理使用,可如果素材都是从盗版网站拿的,还永久保存盗版资料,这种行为不受法律保护,实打实就是侵权。这次音乐行业起诉,直接沿用了这个裁判逻辑,矛头精准对准了AI企业拿非法素材训练这个病根。

面对音乐版权方的指控,Anthropic也没怂,直接对外发了声明,说完全不认同原告的所有主张,不会私下和解妥协,要在法庭上全力抗辩。现在案子刚刚完成立案,所有关于侵权的说法都还只是原告单方面的主张,并没有得到法院的最终认定。谁对谁错,还得等法院给出说法。

这场官司放到全世界,都是AI版权博弈里标志性的大事件。现在做大模型训练,哪家不需要海量的文本素材,正版版权授权的成本高到离谱,很多企业根本扛不起。所以不少AI企业都爱走野路子,直接抓取网络公开内容,甚至直接挪用盗版资源凑数,早就把整个创作圈惹得怨气冲天。这次音乐圈连创始人一起告,就是要抬高AI企业的违法成本,倒逼整个行业建立合规的素材采集机制。

本案最终的判决走向,会直接影响整个生成式AI产业,划定训练数据的合规边界。整个行业都在盯着这个案子的结果,任何判决都可能改变整个产业的发展规则。不少人都觉得,这次就算Anthropic赢了,也给所有AI企业敲了个警钟。

放在咱们国内,其实相关的规矩早就定好了。《生成式人工智能服务管理暂行办法》明确要求,AI服务商必须使用来源合法的训练数据,不能侵害他人的知识产权。歌词、乐谱本身就是受我国著作权法保护的作品,大模型训练不能随便爬取复制使用,更不能拿盗版资源当训练语料。

AI产业想要发展,本来就不能以无偿消耗创作者的劳动成果为代价。想要走得长远,企业就得走正规授权的路子获取素材,不能总想着薅免费羊毛。不光是头部AI企业,普通开发者和普通用户也得树立起版权意识,不管是训练模型还是做二次创作,都得恪守版权规则,别一不小心就踩了侵权的坑。技术创新要支持,创作者的合法权益也得保护,只有两边平衡了,产业才能长久健康走下去。

参考资料:人民日报 《人工智能发展需平衡创新与知识产权保护》