No.0358
Science Partner
Bring you to the side of
导 读
最近科技圈有个事儿挺火,但很多伙伴可能没注意。从今年8月2号开始,做大模型的那个明星公司Anthropic(Claude那家),开始给自家AI生成的文字加“隐形水印”了。
很多伙伴一听,嘴上不说,心里肯定嗤之以鼻,加水印?这套路熟啊!咱就在文档里把它截个图,然后再用个啥OCR软件把图里的字儿提取出来,这“物理洗稿”一条龙走下来,给您整的明白儿的。
那可能您就对AI水印有什么误解了。美国布鲁金斯学会和NIST(美国国家标准与技术研究院)的智库专家跑出来说了,朋友们,你们想多了,对付这种文本水印,截图识字儿大概率是没用了。
这就让人纳闷了,这水印难道成精了不成?
今天 就用大白话给您汇报一下什么叫AI水印,顺便再扒一扒Anthropic这家公司这两年在“埋暗线”这事上的黑历史。从他家之前的所作所为里来预测未来,咱们多少能看出点门道。
走,跟伙伴君来!
今日主笔|旻宏
从“抓抄作业”到”教大家做人”:聊聊Anthropic和AI水印那点事
01. AI水印根本不在“字缝儿”里,而在“基因”里
大家对水印的理解,往往还停留在Word文档里插几个“零宽字符”、或者网页底层藏点HTML代码。这种“物理外挂”,你截个图变成图片像素,确实就灰飞烟灭了。但这次AI巨头们搞的文本水印,走的是“统计学”路线。
这玩意儿怎么说呢?本质上讲,大模型写文章,就跟皇上翻牌子一样。下一个词儿用啥,它是从一堆备选词里“算概率”挑出来的。加了水印的AI,就像被偷偷塞了一副“灌铅的骰子”。系统会根据一个极其复杂的加密配方,把候选词分成“绿牌”和“红牌”。AI在保证语言通顺的前提下,会不受控制地、悄咪咪地多翻几次“绿牌”。
你单看一句话,或者单看一个词,什么毛病都看不出来,通顺得很。但只要文章稍微长一点,掌握配方的检测器拿过来一算:哟呵,这篇文章里“绿牌词”出现的比例,明显违背了自然人类说话的概率法则 。破案了,这代码或者这文章大概率是AI写的。
现在你明白为啥截图不管用了吧伙伴?只要你识别出来的文字没大变,那些“绿牌词”就还在那儿摆着。这就好比你把一碗加了香菜的面条拍成照片,别人照着照片再做一碗一模一样的面条,里面的香菜味,嗷呦,它又飘出来了。除非你大刀阔斧地重写、翻译、大量替换同义词,把它的统计规律彻底打乱,这水印才算失效。
02. 插一句嘴:Anthropic这公司,埋暗线是有前科的
讲到这儿,不得不说一句,Anthropic这次高调宣布“文给字加水印是为了透明!”听着挺正气吧,但翻翻这家公司过去两三年的黑历史,你会发现埋暗线这事儿,他们家是专业的,而且动机一次比一次“巧”。
早在2023年11月,Anthropic就专门搭了一套“行为指纹分类器”,用来揭穿那些拿Claude的蒸馏输出去训练自家竞品模型的公司。这套系统甚至能识别出对方是不是在故意套Claude的思维链(chain of thought),把推理过程整段抠出来当训练素材。
到了今年2月,事儿闹的更大。Anthropic公开指控DeepSeek、Moonshot和MiniMax三家AI公司,用两万四千多个账号、跑了一千六百万次对话,涉嫌以蒸馏方式提升自有模型。蒸馏事儿本来就是一笔说不清的糊涂账,不信请参看
但戏剧性的一幕出现在上个月,一位安全研究员扒出,Anthropic的Claude Code产品从2026年4月起,居然藏着一段没写进公开条款的隐蔽代码,专门在用户开启代理服务时,检测系统时区是否落在东大境内,并把这类信号悄悄编码进系统提示词里。Anthropic一名工程师后来出来解释,说这是3月启动的一项实验,目的是防止未授权转售账号和抵御蒸馏,事件曝光后公司随即将其移除。不是,你要觉得正义你移除干嘛?你要觉得不对,你开始干嘛这么干啊兄弟。
再往前捋一捋,Anthropic的用户协议里还写得明明白白:不许拿Claude的输出去训练任何跟自己竞争的AI模型,谁帮着干这事儿也算违规。2025年8月,Anthropic还中止了OpenAI对Claude API的常规访问权限,理由就是怀疑对方违反这条服务条款、在拿Claude练自家模型,不过同时表示仍会为OpenAI保留基准测试和安全评估用途的有限访问。
你看伙伴,这就有点意思了:一边是自己在API后台埋着看不见的追踪代码,专盯着别人是不是在“抄作业”;另一边现在又高调宣布给普通用户的文字输出加透明水印,说是为了“让大家看清内容来源”。这两件事技术上八竿子打不着,但摆在一起品一品,多少能看出点行业底色:大模型这个圈子,透明度这个词,很多时候先是拿来防别人抄自己家底,其次才轮到照顾普通用户的知情权。这倒不是说加水印这事本身不对,只是咱们在巨头们讲合规、讲透明的时候,最好多问自己一句,这规矩到底是保护谁的利益?
03. 对咱们的菜篮子和钱袋子,到底有啥影响?
绕回主线。这事跟咱们老百姓有关系吗?我也不用Claude啊...其实关系大了去了,特别是对于平时特别在意食品安全、喜欢看深度投研报告的高知、高净值、高颜值的伙伴你来说。
大家想想可能不可能是这么个理:现在互联网上最不缺的就是各种制造焦虑的“小作文”。今天说某种高端食品添加剂致癌,明天搞个看着极其专业的研报说某家公司药丸有问题。以前这帮人想编得像模像样还得费点脑细胞,有了AI之后,一分钟能合成千百篇。
Anthropic这波操作,本质上是给互联网内容上了一道“追踪器”。以后社交平台只要接入检测器,一扫就知道这些耸人听闻的食品安全通报或者投资内幕,是不是AI批量生成的“合成垃圾”。发现不对劲,先给你打个标或者限流,造谣的成本是不是一下子就上去了?您心里话儿,这是好事儿啊。
但咱们也得留个心眼子。美国NIST的智库专家专门提醒过一个常识:AI水印这玩意,绝对不是测谎仪。检测出AI水印,只能证明这段话“可能经过了AI的润色、翻译或生成”,不代表里面的事实就是错的。人家专家用AI帮着润色一下严肃的食品抽检报告,它也会带上水印;反过来,没检测出水印,也不代表这就是金科玉律,万一是纯人类键盘侠在那胡说八道呢?
所以,AI水印它最大的作用也就是给你提个醒:“老铁,这篇东西来路有点机车,先别急着掏钱或者恐慌”。你最终的决策,还是得回到最硬核的一手材料上去:去看正儿八经的监管通报、去看CFDA的临床证据、去看上市公司的相关文件,当然啦,科普的也可以多看 财经的推荐伙伴君经常看的一家叫。
在这个机器写代码、写字比人还溜的时代,巨头们给文字加水印,只是拉开了“用魔法打败魔法”的序幕。而Anthropic自己过去两年在所谓防蒸馏这条线上折腾出的那些黑历史,也提醒着咱们一句挺朴素的道理:规则是谁定的,往往就先保护谁。
咱们普通人最值钱的能力,其实早就不是“快速获取信息”了,而是“冷静甄别信息”,不管是甄别AI写的小作文,还是甄别大公司嘴里说的“为了透明“”为了你好”。毕竟,AI可以给文章打上隐形的代码,但给认知把关的,永远只能是您自己的脑子,您说是不是这个理儿。
我是旻宏,咱们下期见~
本文仅作科普分享使用,欢迎小伙伴们点、收藏、关注,以备不时之需,当然更欢迎您把 介绍给周边可能需要的更多伙伴们呀。
热门跟贴