一个下载了约70GB学术论文的人,被法律系统逼到绝路;一个抓取了80TB书籍训练AI的科技巨头,却几乎毫发无损。这两件事放在一起,很难不让人愤怒。

亚伦·斯沃茨,RSS协议联合创始人之一,因从JSTOR“非法”下载约70GB学术文章而遭到起诉。检方指控之重,令人瞠目——面临最高35年监禁、100万美元罚款以及资产没收。如此严厉的指控,被普遍认为是“杀鸡儆猴”式的警告。最终,斯沃茨在法庭拉锯战和即将到来的财务崩溃面前,选择结束了自己的生命。

打开网易新闻 查看精彩图片

斯沃茨的初衷:知识的传播与存档

斯沃茨的行为动机,是学术知识的传播与存档。他希望通过下载这些论文,让更多人能够接触到学术成果,打破付费墙对知识的封锁。这是一个理想主义者的行动,尽管手段在法律上存在争议。

而Meta的做法则完全不同。这家科技巨头抓取了80TB的书籍数据,用于训练其AI模型。这80TB的数据量,是斯沃茨案中70GB的千倍以上。但Meta面临的后果,仅仅是一场官司,而且大概率只是“象征性罚款”——与此同时,他们的AI模型仍在持续创造巨额利润。

两起案件,两种结局

打开网易新闻 查看精彩图片

两起案件的核心差异,或许在于目的与身份。斯沃茨的用途是知识传播,Meta的用途是驱动其专有的“抄袭代码”——这套系统不仅消耗大量环境资源,还让CEO们陷入某种狂热,同时让全球最富有的人变得更加富有。

作者在文中坦言,自己从未见过斯沃茨,但常常替他感到愤怒。“我不知道该拿这种愤怒怎么办,也许变得更激进才是最好的出路。”这种无力感,或许正是许多关注此案的人共同的心声。

文章结尾附上了一张猫咪照片,名字叫莉莉丝。“她想知道,为什么我们不对这些科技亿万富翁做点什么。”这看似轻松的调侃,背后是对科技巨头数据抓取行为长期缺乏有效监管的无奈。

一边是70GB论文引发的灭顶之灾,一边是80TB书籍的轻描淡写。数据抓取这件事,到底该以什么标准来评判?答案,恐怕比我们想象的要复杂得多。