打开网易新闻 查看精彩图片

在人工智能道德高地上声量最大的Anthropic,最终没能躲过自身数据原罪的惩罚。

美国旧金山联邦法院正式批准了一项创纪录的15亿美元和解协议,彻底扫清了近五十万名作家与出版商索赔的法律障碍。

这笔美国版权诉讼史上金额最大的天价赔偿,让这家一直将安全与合规挂在嘴边的AI巨头付出了极其惨痛的代价。

这一裁决不仅为长达两年的版权拉锯战画上了阶段性句号,也暴露出大模型研发早期粗暴获取数据的行业沉疴。

转化使用背后的盗版获取死穴

打开网易新闻 查看精彩图片

这起轰动全球的集体诉讼起源于安德里亚·巴茨等多位知名作家的联合起诉。

原告指控Anthropic在未经授权且未支付任何费用的情况下,私自下载并利用大量盗版图书训练其旗下的克劳德大模型。

负责审理该案的主审法官在前期的判决中,其实认同了AI行业梦寐以求的法律避风港。

法官裁定利用合法获取的版权书籍训练AI属于对原作的转化利用,在原则上符合版权法中的合理使用条款。

然而Anthropic最终输掉官司的关键,在于其获取与存储数据的方式彻底触犯了法律红线。

调查显示该公司的内部系统中搭建了一个名为中央图书馆的数据库,里面秘密囤积了超过七百万册盗版图书。

这些非法数据主要下载自图书基因库以及海盗图书镜像等知名盗版资源站点。

这种脱离特定训练项目且长期留存盗版资源的行为,直接剥夺了其援引合理使用原则进行辩护的合法资格。

面临可能高达数千亿美元的法定惩罚金风险,Anthropic不得不选择掏钱和解以规避灭顶之灾。

这笔高达15亿美元的赔偿金将覆盖近五十万种被侵权的图书,平均每本书的赔偿额度达到了三千美元。

公司副总法律顾问试图将这一结果解释为结案而非让步,但大肆下架和销毁盗版数据的举动已说明了一切。

即便九成以上符合条件的作者和出版商已经提交了领钱申请,该公司的法律噩梦依然远未结束。

部分拒绝参与集体和解的出版商和作者发起了独立诉讼,其后续应对版权官司的法律支出还将继续飙升。

从反向蒸馏到版权原罪的双重标准

这起历史性判决落地的时机,给Anthropic在舆论场上的威信带来了毁灭性的打击。

就在过去几个月里,这家公司一直以知识产权受害者的姿态向美国监管机构与公众大声疾呼。

它公开指责包括DeepSeek、月之暗面和MiniMax在内的多家中国AI实验室,称其通过虚假账号和海量查询提炼其克劳德模型的能力。

它甚至将这种模型蒸馏行为包装成对西方技术领先地位和国家安全的重大威胁。

然而这种高调维权的姿态,在这个高达15亿美元的盗版丑闻面前显得无比讽刺与双标。

包括埃隆·马斯克在内的多位行业批评者指出,Anthropic一边靠盗版图书起家,一边却严禁对手从其模型中汲取价值。

尽管支持者强调盗版图书与绕过付费接口蒸馏模型在法律细节上有所不同,但公众显然并不买账。

对于一家将安全与原则作为核心商业卖点的人工智能公司而言,秘密建立盗版图书馆的行为彻底打破了其道德光环。

这场诉讼为整个生成式AI行业敲响了沉重的警钟。

靠不光彩手段疯狂搜刮数据的野蛮生长时代已经彻底终结,忽视数据来源合法性的后果终究需要付出巨额真金白银。

各家AI巨头必须明白,唯有建立透明且合规的数据授权机制,才能在未来的全球竞争中真正立于不败之地。