图片有水印并不新鲜,生成文字怎样加水印,却一直是个令人困惑的问题。
Anthropic 最新给出了答案:未来 Claude 模型生成的文字,会带上一种人眼不可见、但可以通过统计方法检测的水印。
这项技术可能改变学校、媒体、内容平台和企业处理 AI 生成内容的方式。但它最需要防范的风险,也正是人们把一种“概率线索”误认为确定证据。

打开网易新闻 查看精彩图片

### 水印不藏在字符里,而藏在选词规律里
Claude 的水印不是在文字后面偷偷加一串代码,也不是复制粘贴时会跟随的文档元数据
大语言模型每次生成下一个词,通常会面对多个合理选项。例如一句话的意思不受影响时,选择“阴冷”还是“灰暗”,对读者可能并不重要。水印机制会利用密钥和前面的词,决定这些低风险选择中的随机方式。
一次选择看不出区别,但一段足够长的文本里存在许多类似决定,最终就会形成一种统计模式。拥有检测密钥的人,可以计算这段文字与 Claude 水印模式一致的概率。
Anthropic 表示,该方案基于 SynthID-Text 思路,不添加隐藏字符,不需要额外 token,也不会携带用户或组织身份信息。公司称内部测试未发现对内容、创造力和可读性的实际影响。
但这些结论目前主要来自厂商及相关技术研究,未来仍需要更多独立验证,尤其是中文、翻译和不同文体中的表现。
### 水印能证明“参与”,不能证明“作者”
这是整件事最重要的边界。
Anthropic 明确指出,检测到水印,只能说明 Claude 很可能参与过内容生成。它无法区分一篇文章是由 Claude 从头写到尾,还是人类完成了主体后让 Claude 大幅编辑。
如果用户只是让 Claude 改正几个标点或语法错误,大部分词语仍由人类选择,可供水印附着的空间很小;事实性内容和精确代码同样如此,因为正确答案往往没有足够多的同义选择。
反过来,翻译由 Claude 决定几乎每一个词,因此更可能留下水印。大幅改写也可能破坏原有统计模式。
这意味着水印不是传统意义上的“作者身份证”。它更像一种接触痕迹:能提示 Claude 可能来过,却不能独立说明人类贡献了多少。
### 为什么现在推出?
Anthropic 表示,这项变化与欧盟 AI 法案的透明度要求有关。公司计划在全球推出,因为目前缺乏稳定的地区隔离方式。旧模型也会在过渡期内逐步加入相关机制。
这可能推动学校和平台制定新的 AI 内容标注规则,也可能带来新的争议。
如果平台把水印检测结果作为风险提示,并结合写作过程、引用记录和人工审查,它会增加透明度;如果把一个概率结果直接变成处罚依据,则可能制造新的误判。
尤其在教育场景里,学生可能只是用 AI 做翻译、语言润色或结构建议。检测到 Claude 参与,并不等于学生没有完成原创思考。
### 检测工具尚未开放
Anthropic 表示将推出水印检测 API,但具体时间、使用资格和判断阈值尚未公开。
在这些细节明确之前,任何声称“已经能百分之百查出 Claude 写作”的产品或结论,都需要谨慎看待。
水印技术解决的是生成内容透明度问题,不是替学校、平台和企业作出价值判断。真正合理的制度应该明确:什么程度的 AI 辅助需要披露,哪些用途可以接受,谁有权检测,以及用户如何申诉。
AI 文字开始留下痕迹,或许是一个必然方向。但技术能告诉我们“谁可能参与”,并不代表它能替我们回答“谁是作者”。