编辑|山辉
AI 写的文章以后真藏不住了。
OpenAI 官方公告,包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的一大批公司,签署了欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。
OpenAI 表示,根据其对欧盟 AI 生成内容透明度准则的承诺,目标是将来源信号扩展至包括文本在内的所有模态。
看起来 AI 内容马上也要有「署名」了。
最近许多前沿公司都在拓展欧洲业务,但欧盟的规矩可谓是相当多,这个《AI 生成内容透明度行为准则》就是其中之一。
从 8 月 2 日起,欧盟法案中关于内容透明度的要求就已经生效:AI生成或操纵的文本、图像、音频和视频,需要以机器可读的方式进行标记,并且能够被检测出来。
不过签署准则是一回事,真要说因此行动的,Claude 是第一个。
Claude 的「署名」规则
不久前,Anthropic 公布了 Claude 落实这套规则的具体方案。
链接:https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
重点有几个:
1、从 8 月 2 日起,如果在欧盟推出的新 Claude 模型,「AI 水印」将在上线时就启用;
2、「AI 水印」直接嵌入生成文本中,人眼不可见,但机器可以检测。复制粘贴之后水印会保留,甚至经过一些编辑后水印也不一定消失;
3、对于 svg、png、jpg 等文件,Claude 会附加经过数字签名的来源元数据,采用 C2PA 开放标准。这样的「AI 水印」可以表明文件曾经由 Claude 处理,同时帮助判断文件之后是否遭到篡改。
4、虽然是欧盟的规则,但这套机制不局限于欧盟用户。并且水印从模型层加入,无论从Claude、API 还是第三方云服务调用,在 Claude 生成的内容都会带上「AI 水印」。
除了这些,根据欧盟给出的过渡期,Claude 的旧模型也应该在 12 月 2 日之前补上「AI 水印」。
也就是说,按目前的节奏,到 12 月 2 日之后,Claude 的「AI 水印」将进一步覆盖全球、全模型、全渠道。
对于其他签署公司,情况也是如此,只不过方法可能有所不同。
水印其实早就有了
关于怎么加「水印」,Anthropic 表示还要等后续技术文档。
不过这种文本水印本身不是什么新鲜概念。
早在 2024 年,DeepMind 就公开过一套「SynthID Text」方案,并且已经用在了 Gemini 和 Gemini Advanced。
论文链接:https://www.nature.com/articles/s41586-024-08025-4
如果因为「水印」这种说法,联想图片里的覆盖性 logo,那可以就错了。
SynthID 会在大模型生成文字的过程中,对 token 的生成概率做非常轻微的调整,让模型一次次选词时留下特定的统计规律。等整段文字生成完成,这些选择累积起来,就形成了水印。
检测时,再反过来检查这些词语选择是否符合带水印文本应有的统计模式。
Google 公开的测试显示,裁掉部分文本、修改少量词语或轻度改写时,仍然可以检测出信号;但如果彻底重写或者翻译成另一种语言,检测置信度就可能大幅下降。
并且 Google 还曾在接近 2000 万条 Gemini 真实响应中测试这套方案,结果显示,加入水印后用户对文本质量的评价基本没有变化。
「署名?这真是你写的吗」
这事一出,网友都在喊「退订」。
「水印」本身的可信度遭到了质疑,连 Anthropic 自己都提到,有「水印」不一定就是 AI,同时,经过大量改写或者混入人工内容,「水印」也会被削弱,甚至检测不出来。
评论区还有一种声音:使用什么工具不重要,重要的是最终质量。
通常来说,读者或者观众担心的是 AI 内容是否真实可靠。那么特意强调「这部分用了 AI」,其实有「提醒读者注意核查事实」的意味。
在这个过程中,原本属于内容生产者或者平台的核查压力,可能在不知不觉中被推向读者和接收者。
另一方面,既然要打「水印」,那这就不得不反问一句:这真的能算是「AI 写的」吗?
你怎么看?
热门跟贴