在大模型的牌桌上,硅谷的科技巨头们原本正经历着一场前所未有的“渡劫”。
《纽约时报》索赔数十亿美元,环球音乐、索尼音乐组团围剿,美国作家协会甚至把 OpenAI 告到了联邦法院。
此前 Anthropic 一案中,法官甚至裁定赔偿金高达 15 亿美元,打破了美国版权史纪录。各大 AI 厂商每天悬着心,眼看着自己赚的那点订阅费,全都要赔给这帮“纸媒老顽固”和“唱片巨头”。
然而,就在出版商们打着算盘坐等收钱的骨眼上,剧情突然反转。美国联邦政府直接向法院递交了一封“核弹级”信函。
政府律师在信中斩钉截铁地拍板:利用受版权保护的作品训练大模型,完全属于“合理使用”!不仅合法合规,而且必须力保。
更绝的是,政府直接给出了一个让全网直呼“好家伙”的比喻:大模型抓取全网文章学习,就跟当年一位叫子琼·狄迪恩(Joan Didion)的女记者在打字机上一字一句抄写海明威的小说来提升写作技巧一模一样。
把几十万张高功率 GPU 昼夜不停地暴力擦洗、吞噬全网数据,包装成“文学少女的求知若渴”,这种语言艺术实在让人叹为观止。
子琼·狄迪恩(Joan Didion)
盖章“免死金牌”:当白嫖被打上“国家安全”的钢印
如果只是比喻有灵性也就罢了,这封信真正令人脊背发凉的,是它直接把一场普通的经济诉讼,提升到了“地缘政治与国家安全”的高度。
美国政府在信中公然警告:如果让《纽约时报》胜诉,将对美国的繁荣和经济流动性造成“灾难性后果”。因为大模型训练是否符合“合理使用”,关系到美国人工智能产业能否“保持其在全球 AI 领域的绝对领先地位”。
这话翻译成大白话就是:现在是全球科技霸权的生死存亡时刻,谁要是在这个时候追着 AI 厂商索要天价数据授权费,谁就是在给外国竞争对手送优势,谁就是阻碍国家进步!
一柄“危害国家安全”的大棒打下来,《纽约时报》们手里的谈判筹码瞬间变成了烫手山芋。原本是版权方与科技巨头的商业博弈,一转眼变成了“你阻碍国家繁荣”的政治审判。
《纽约时报》发言人当场炸毛,痛批政府这是在牺牲无数创作者的利益,去偏袒少数几家市值万亿美元的科技巨头。美国作家协会首席执行官也怒斥该信充满错误。
但在最高行政力量和国家安全战略面前,创作者们的呐喊显得苍白无力。这不仅仅是给 OpenAI 解套,更是用国家意志为整个硅谷的生成式 AI 产业开了一条无障碍绿色通道。
历史的回响:二十年前的那场“电子书大劫案”
其实,这种“为了科技繁荣而牺牲版权”的套路,硅谷早在二十年前就演练过一次。
2005 年,谷歌启动了宏大的“谷歌图书”项目,未经授权私自扫描了超过 2000 万本图书建立电子索引。美国出版商协会和作家协会集体起诉谷歌侵权,这场官司整整打了十年。
到了 2015 年,美国第二巡回上诉法院给出了终审判决:谷歌胜诉。
法院认为,谷歌并没有完整复制再版图书去卖钱,而是将书籍“转换”(Transformative)成了一种全新的检索工具。这种“转换性使用”创造了巨大的社会价值,属于“合理使用”。
“谷歌图书案”成了硅谷科技公司的护身符。二十年后,大模型时代到来,OpenAI 们直接抄了当年谷歌的作业:
大模型把几百亿网页吞进肚子里,并不是在数据库里存了一份盗版 PDF,而是把文本砸碎,转化为高维空间里的概率权重。它学习的是语言的规则、世界的知识,这难道不比当年谷歌的搜索引擎更加具有“转换性”?
为了避开早期直接侵权的风险,行业里还衍生出了一条精妙的“数据洗白链”。大厂们不方便直接去爬盗版网站,就通过 Common Crawl 这样的非营利机构或者开源社区(比如包含几十万本盗版图书的 Books3 数据集),打着“纯学术研究”的幌子整理好,再转手喂给自己的商业大模型。
从“学术洗白”到“合理使用”,硅谷用二十年的法律博弈,生生在版权法典上打出了一个巨大的漏洞。
算力狂飙下的荒谬:免费的薪柴与加冕的神
然而,这次政府的强行保驾护航,暴露出的却是一个更加残酷的产业危机——“高质量人类数据枯竭”。
根据机构预测,互联网上积累的高质量人类真实文本,很可能在未来两三年内被大模型“吃干吃净”。为了抢夺优质数据,在政府表态之前,OpenAI 和 Google 已经不得不掏出数亿美元,跟 Reddit、美联社等签署数据采购协议。
如果不给“白嫖”盖章合法,下一代千亿级、万亿级参数大模型的训练,光是数据采购费用就可能是一个天文数字。这不仅会让 OpenAI 这样的巨头流血,更是会直接掐死所有缺乏资金的初创公司。
为了让大家读懂这里的荒谬逻辑,不妨来看几个生活中的案例:
一个智商超群的学霸(AI)走进书店,免费把店里 10 万本书通读了一遍,掌握了世间万物的规律,回家写出了一本新书。书店老板(出版社)要打断学霸的腿,说你抄了我的书。
学霸说我只是“看了”你的书,变成了我大脑里的神经元记忆。法院裁定:看书不违法,学霸可以自由看。
国家要修一条通往未来的科技高速公路,但公路穿过了很多私人农田(创作者的内容)。每一个地主都在领地上设卡收费,AI 车队每开过一米都要付天价过路费。
政府一看这还得了?直接下一道命令:所有农田划归公共通行权,收费站全部拆除,谁阻拦谁就是破坏国家交通建设。
AI 厨师尝遍了天下上万家餐厅名厨的独门绝学,融会贯通后做出了全新的百家菜。
名厨们要 AI 厨师为尝过的“每一口菜”付费,而政府却拍着 AI 厨师的肩膀说:它只是舌头好、会总结,这叫正当创新。
这套逻辑在商业上天衣无缝,在法律上自圆其说,却在伦理上构成了一个极其刺眼的悖论:
人类记者、作家、艺术家们熬夜码字、画画,倾尽心血填满了互联网的数据池。AI 像饕餮一样免费吞噬了这些心血,学成之后不仅不付学费,反而迅速抢走了创作者们的饭碗。
而当创作者们拿起法律武器试图维权、讨要一口饭吃的时候,却发现对方早已披上了“国家安全”与“全球霸权”的黄金甲,自己反而成了挡在科技进步车轮前的不识大体的“绊脚石”。
终局博弈:规则是强者的游戏
白嫖数据合法化,等于直接给硅谷的 AI 狂欢注入了万亿级别的资金血泵。
它省下的不仅仅是天价的数据采买费,更是消除了整个行业悬在头顶的破产悬剑。从此,无论模型怎么吞噬世界,只要打着“合理使用”和“为国炼丹”的旗号,就可以在合规的坦途上狂飙突进。
普罗米修斯盗取天火,尚且需要绑在高加索山脉上忍受恶鹰啄食内脏的痛苦;而在今天的算力狂潮中,把全人类的知识结晶当成免费的薪柴丢进 GPU 炉膛,不仅不需要付钱,还能获得至高权力的加冕与褒奖。
在科技霸权的终极棋局里,道德与版权从来都只是平静水面上的波浪,而国家意志与算力野心才是深海里的暗流。
当“合理使用”的解释权被权力与霸权重构,那些曾经在打字机前敲击出人类文明火花的人们,终究只是为这场狂欢提供了最初的燃料。
至于这究竟是科技文明的伟大胜利,还是人类智力遗产的终极掠夺?在算力咆哮的轰鸣声中,答案早已不言而喻。
热门跟贴