经过四年的狂飙突进,如今即使是再食古不化的人都得承认,AI复刻了互联网的发展路径,已经逐步渗透到我们日常生活的方方面面,一场由AI发起的社会变革正在进行。当AI生成的内容越来越有人味,人产出的东西开始有AI感,大家对于“真”的需求就来到了史无前例的高度。

打开网易新闻 查看精彩图片

“作者到底是真人还是AI”,已经成为不少朋友看到一篇文章、一张图片、一段文字时,脑海中率先冒出来的问题。为了区分人类的作品与AI生成的内容,水印技术曾经是AI厂商给出的解决方案。只可惜受限于彼时的技术条件,“AI水印”的效果不及预期。

时隔三年,隐写数字水印技术再一次走向前台。Anthropic方面日前宣布,8月2日及以后发布的Claude模型将从上线起为生成内容加入机器可读标记。其中,Claude生成的文本会嵌入人眼无法察觉的隐写数字水印,这种水印不会改变文本的含义、质量和可读性,但会嵌在文本的统计分布里,复制粘贴也会被带走,部分编辑也无法抹除。

如今,Turnitin等第三方AI检测工具受到的争议已经越来越多,这类AI检测工具是围绕“困惑度”(Perplexity)和“突发性”(Burstiness)两个指标展开,核心机制是衡量词语的可预测性和频率变化。

打开网易新闻 查看精彩图片

然而随着人类创作的语料被慢慢填进AI大模型的语料库,AI输出的内容也与人类变得越来越像,以至于检测结果显示“像AI”,并不等于就证明“是AI写的”。Turnitin在2023年识别AI内容的准确率曾高达98%,到2026年,却因为多次误判学生论文AI率100%,而被十余家欧美顶尖高校停用。

传统AI检测工具是从用词、修辞、句式等语言特征入手,而Anthropic的模型水印则不同,它是在AI生成内容的同时加入标记。传统AI检测适应不了新AI模型只是诱因,Anthropic突然为自家模型输出的内容打上水印,根源在于其创始人Dario Amodei身上。

如果经常关注AI行业的消息,想必对Dario Amodei不会陌生,信奉有效利他主义让他成为了AI圈的戏精,时不时就公开发表各种逆天言论,诸如“Anthropic是人类文明最后的希望”“为了不让AI毁灭全人类,必须由Anthropic做出最强大的AI”。纵观Dario Amodei的这些言论,他的核心主张是“友商的AI坏,我们的AI好,坏AI要被限制,只有我们能做好的AI”。

打开网易新闻 查看精彩图片

在“AI是危险的‘核武器’,按钮必须掌握在Anthropic手中”这一观点的主导下,Claude模型给自己输出的内容打水印,其实在某种程度上正是Anthropic“安全>伦理>合规>有用”叙事中的一环。虽然Anthropic反复渲染AI安全叙事是为了自己的商业利益,但安全这张牌在企业级市场确实权重极高。

当然,Anthropic能成为全球数一数二的AI独角兽,自然也有两把刷子。当年,Anthropic建立的时候将“宪法AI”作为技术框架,将安全、可控注入Claude的基因,才有了后续Claude在企业级市场的风靡。现在Anthropic又主动在模型层面区分人类创作与AI生成,也不完全是为了眼前的生意,更有对未来的考量。

此前在今年6月,全球知名内容分发网络(CDN)Cloudflare发布的统计报告显示,AI智能体所产生的互联网流量,有史以来第一次超过了真实人类用户的流量。Cloudflare方面预测,在未来5年内,AI智能体创造的流量可能会超过人类创造流量的1000倍。对此,马斯克也发推力挺,“这一点毋庸置疑,Cloudflare的预测是准确的。”

打开网易新闻 查看精彩图片

在AI贡献的流量超过人类创造的流量时,AI主动给自己生成的内容打水印其实不是厂商良心发现,而是如果不区分人类与AI,现行的互联网商业模式可能将会倾覆。当网络上的内容由AI生成、再由智能体消费,那么现行的商业体系也就失去了价值,比如数字广告不再有意义,因为看广告的主体变成了AI。

过去这二十年,整个互联网商业的底层逻辑是默认屏幕另一端坐着的是人,几乎所有的商业变现都是围绕人的注意力展开。当互联网流量的主体从人变成AI,情况就变了。毕竟AI是没有视觉疲劳的,也不会被光怪陆离的弹窗广告诱惑,更不会因为感性故事而被种草。

打开网易新闻 查看精彩图片

互联网生态的服务对象从人类变成AI,对于互联网厂商来说并不是不能接受,但现在的基础设施还没有做好变轨的准备。当下的问题是AI生成的内容流量增长过快,Cloudflare最初预测AI流量超过真人流量的节点是2027年年末,后来又修正到2027年年初,可现实结果却是2026年6月。

所以Anthropic主动给AI生成的内容打水印,其实是在给AI流量踩刹车。

【本文图片来自网络】