The Mark of the Machine
很少有力量能像公开羞辱一样,有效约束人工智能的使用。如今,Anthropic正让判断一段文本是否由Claude生成变得更加容易。
2026年8月19日
插图:Ariel Davis
上周,Anthropic 宣布了一项出人意料的政策变化:该公司大型语言模型 Claude 生成的文本将添加一种隐形水印。如果有人将聊天机器人生成的段落复制粘贴到另一份文档中,人工智能检测工具便能判断该段落极有可能经过了 Claude 的处理。当然,人工智能检测系统并非新鲜事物;诸如 Pangram 和 Turnitin 等工具早已在学术界和出版领域扎根。不过,这些工具是通过海量数据训练,以识别构成明显人工智能写作“风格”的统计模式;而 Claude 的水印则直接嵌入到文本本身,甚至精确到单个词语层面,这使得大型语言模型用户可能更难通过编辑手段抹去自己使用过人工智能的证据。
互联网上,针对机器与其人类提示者之间所谓“破裂合同”的批评如潮水般涌来。难道L.L.M.不正是被专门宣传为能够将机器生成的作品伪装成自己的原创吗?事实上,许多人最初使用L.L.M.,不正是看中了这种可能性吗?如今,对于那些早已习惯用聊天机器人撰写论文的学生、暗中借助L.L.M.起草文章、通讯和书籍的记者与作家,甚至依赖Claude撰写法律文书和动议的律师们来说,这场骗局似乎已彻底暴露。“这些人一出这趟流程,脸上就烙上了数字纹身,”一位Reddit用户在一篇迅速走红的帖子中写道——而这篇帖子本身看起来也像是由人工智能生成的。(我用AI检测工具对其进行了分析,结果确实百分之百是L.L.M.“辅助”创作的。)“污名啊,”这位发帖人继续写道,“天哪,这污名……”
在缺乏全面的联邦人工智能监管法规、且各领域——包括专业、学术与艺术——对其使用规则不统一甚至常常相互矛盾的情况下,鲜有力量能像公众羞辱那样有力地遏制人工智能对人类创造力构成的威胁。“直白地说,使用人工智能理应让你感到内疚,”去年,n+1杂志的编辑们在一篇抨击大型语言模型的文章中写道,“污名化是一种强大的力量,而厌恶与羞耻正是我们最有力的武器之一。”随着生成式人工智能日益广泛地渗透到我们的文化与政治生活之中——从备受瞩目的短篇小说奖得主,到主流唱片公司的专辑发行,再到总统宣传——如今,普通民众不得不肩负起监督机器生成内容违规行为的责任,以尽力守护我们这个物种尚存的一丝伦理尊严与批判性思维。当然,指责者有时难免过于激进,提出的指控并不总是确凿无疑,尤其是在“100% AI生成”这一表述俨然成为一种文化“红字”的当下。不过,随着Claude新推出的水印技术问世,或许辨别“真”与“假”的过程将变得更加顺畅、更加万无一失——这也将成为我们迈向与大型语言模型及更广泛的生成式人工智能建立一种更为透明、更为审慎关系的踏脚石。
显然,Anthropic设立水印并非为了劝阻人们使用Claude,也并非为了让其产品显得不那么有吸引力——那么,它为何还要一开始就让自动生成的文本更明显地可追溯呢?该公司在官方公告中解释称,这一调整是为了遵守欧盟《人工智能法案》,该法案要求大型语言模型提供商必须使由人工智能生成的文本能够被明确标识。这种标识可以采用水印、元数据或加密信号等形式——即通过统计特征来构建签名,以便检测系统能够判断一段文字、图像或音频是否由人工智能生成或经过篡改。例如,谷歌Gemini在其人工智能生成的内容中便采用了名为SynthID的水印技术。目前,OpenAI仅对图像和音频实施了检测手段,但随着欧盟《人工智能法案》中的“透明度义务”正式生效,该公司表示正在“努力扩展针对ChatGPT文本的来源追踪措施”。这些人工智能公司特别强调,像水印这样的追踪属性对于普通读者而言是完全不可见的,也无法追溯到实际触发大型语言模型生成该文本的人——当然,除非此人试图将该文本冒充为自己的原创作品并被检测系统识破。
然而,Anthropic的动机或许并不仅限于遵守欧盟规定,以及践行其标榜的安全与透明价值观。这家公司很可能单纯地希望,让其模型更容易验证人类撰写的文本,并在训练大型语言模型时排除由人工智能生成的内容——毕竟,如果用人工智能生成的内容来训练人工智能模型,可能会导致模型的可靠性和质量下降。(这真是个讽刺!)此外,Anthropic或许还意图通过“来源追踪”这一备受人工智能供应商推崇的概念,强化对其大型语言模型输出成果的控制,从而确立一种知识产权,使其产品所创造的内容独树一帜、区别于竞争对手。很难不认为,整个标识操作在某种程度上其实是一种人工智能监控技术的升级——它能够追踪聊天机器人的话语在离开机器后流向何处,进而建立起一个详尽的使用案例数据库,为未来的引用和推广做好准备。“你知道这让我想起了什么吗?”那位精神恍惚的Reddit网友在其反水印宣言中写道,“就像那些警方行动,抓了吸毒者却放过了毒贩。水印技术本质上也是这么回事。”像Anthropic这样的公司,或许会合理地将水印技术视作一种无害且合乎情理的演进:它既能为公司的训练数据锦上添花,又能合法合规地提升人工智能的透明度,还能帮助判断某段内容是否源自自家模型。但对用户而言,水印的痕迹更多意味着一种毫无意义的社会惩罚——一种旨在污名化任何敢于使用人工智能生成内容、而非深入挖掘自身思想深处的人的手段。
一些评论家指出,这种水印对于识别除明显使用聊天机器人之外的其他情况,效果将大打折扣。当像Claude这样的大型语言模型生成文本时,它通常会从一系列统计上可能的选项中挑选词语。然而,有了水印之后,该模型便会倾向于更预先设定好的一组结果。这些结果累积起来会形成一种统计模式,从而让检测系统能够计算出Claude生成某段文本的可能性。如果有人对大型语言模型生成的文本进行严格编辑或重写,检测系统或许就难以捕捉到这种模式。但或许这恰恰是一种优点,而非缺陷——毕竟,水印的目的不正是要捕捉那些最明显的、利用人工智能进行写作的滥用行为吗?或者说,至少应该建立一种比目前完全无监管的体系更为合乎伦理的内部机制,不是吗?
除了担心水印不过是障眼法、一种易于规避的合规策略之外,一些反对水印的人还担忧,这些统计特征可能会降低聊天机器人的写作水平。科技博主约翰·格鲁伯指出,Claude如今更可能默认使用带水印的词汇,而非充分发挥其语言表达的全部潜力,这可能导致生成的文本质量下降,甚至在某些情况下完全无法使用。如果大型语言模型开始倾向于特定的同义词或短语,从而削弱说明书或医生处方等文件的解释力与精准度——而这类文件正越来越多地被外包给大型语言模型处理——那么这种结果确实有可能出现。不过,许多专家一致认为,格鲁伯的担忧有些夸大了。伦敦大学学院安全工程教授史蒂文·默多克在接受《卫报》采访时表示,这一变化“很可能不会产生任何明显影响。”
当L.L.M.的拥趸们争论水印是否会削弱人工智能的写作能力时,撰写了热门科技与媒体通讯《Stratechery》的本·汤普森却对“人工智能居然能被视为作者”这一说法感到极为不满。(遗憾的是,他的论点并非美学层面的,而是更偏向技术性。)他指出,L.L.M.是由人类“操控”的,因此根本无法被视作任何事物的创作者:“坚持要求标注水印,无异于坚持让一支圆珠笔自诩为作者——这种观点显然荒谬至极。”他对人工智能创作权的看法可谓目光短浅、令人瞠目。他似乎假定,人们使用L.L.M.的方式就如同使用一支笔一般——将它当作一个空洞的技术工具,单纯用来记录有意识的思想,完全无视任何可能改变思想本身的中介作用,更遑论对语言本身的干预了。然而,抛开那些杞人忧天的担忧和虚假的类比不谈,批评人工智能检测系统的论者其实是在呼吁一种再简单不过的事情:他们认为,与聊天机器人互动存在合乎伦理且毫无争议的方式,比如进行文本校对或审稿。那些恰当使用聊天机器人的用户,完全不必每次将一段来自Claude的文字粘贴到文字处理软件中时,就担心遭到公众羞辱或污名化。
在当前人工智能的浪潮中,这种关于真实与虚假、美德与虚伪之间的哲学界定正日益瓦解并扭曲,逐渐演变成科技巨头们所希望我们理解的——与他们的产品“协作”。尽管汤普森认为,大型语言模型并不创造新思想,而是帮助人类实现他们早已拥有的想法,从而让人类能够与人工智能和谐共进,但显而易见的是,我们大多数人依然在意区分人类劳动与机器统计输出之间的差异,也依然珍视全凭自身努力所取得的成就,而非仅仅因为某项成果得到了大型语言模型的“辅助”或“助力”而沾沾自喜。
在文章《诗歌与原始状态》中,作家加里·斯奈德将诗歌定义为:“以娴熟而富有灵感的方式运用声音与语言,去呈现那些罕见而强烈的心灵状态——这些状态最初源自歌者的个人体验,却在深层意义上与所有聆听者息息相通。” 这就是为何每当有艺术家被发现使用人工智能——往往未予披露——便会引发轩然大波;也正因如此,当学生们连最简单的作业都选择自动化完成时,教授们仍不免感到震惊不已。无论是撰写论文、创作歌曲、编写故事、吟诵诗歌、编写剧本、撰写文章、撰写博客,抑或发送电子邮件——无论何种形式的写作,都不应仅仅沦为达成某种目的的手段,也不应单纯以“是否奏效”或“能否实现预期目标”这样的效率指标来衡量。真正的写作,应当源自我们自身那些机器永远无法触及的内在部分。“一只按下按钮的手或许拥有巨大的力量,但那只手永远学不会手本身所能创造的一切,”斯奈德写道,“诗歌必须从真实的经验中歌唱或诉说。” 安thropic公司的水印技术看似预示着一个未来:人类与机器能够诚实而合乎伦理地共存,人们使用大型语言模型时也将完全透明公开。也许这一天真的会到来——但愿我们对人工智能的偏见与污名化能继续守护住我们双手的尊严:它们既能按下按钮,更能够成就更多、更深远的事物。♦
本文作者:Brady Brickner-Wood是一位散文家和文化评论家,他的作品曾发表在《纽约时报》、《时代杂志》、《Pitchfork》和《德克萨斯月刊》上。
说明:本号刊发来自各方的文章,是为了获得更全面的信息,不代表本号支持文章中的观点。由于微信公众号每天只能推送一次,本站目前在腾讯新闻发布最新的文章,每天24小时不间断更新,请在腾讯新闻中搜索“邸钞”,或在浏览器中点击:
https://news.qq.com/omn/author/8QIf3nxc64AYuDfe4wc%3D
热门跟贴