上周末,有用户意外发现,部分Anthropic旗下Claude AI的对话分享链接,竟能通过谷歌等搜索引擎直接检索到。这一问题并非后台数据库泄露或未分享对话遭窃取,而是源于用户自行生成的公开分享链接,被搜索引擎爬虫抓取并收录。按理说,这些分享链接本应只有知晓完整URL的人才能访问,但搜索引擎将其纳入公开索引后,任何人都可能通过简单的搜索指令找到并查看会话内容。

被搜索引擎抓取的风险在于,用户通常以为将链接私下发给同事或朋友就是安全的。但从网页技术层面看,只要这类链接出现在公共页面、论坛签名、社交媒体等任何公开角落,爬虫就有机会发现并索引。这意味着,那些分享出去的Claude对话,极有可能在用户毫无察觉的情况下,被全球网民检索到。有网友测试后发现,部分被收录的会话中,竟明晃晃地包含着加密货币钱包私钥、违反平台规定的咨询记录、公司内部任务信息,以及可直接追溯到个人的身份资料。

打开网易新闻 查看精彩图片

尽管Claude在用户生成分享链接时会弹出风险提示,但大量用户显然并未意识到,只要链接本身存在且未被搜索引擎排除,会话内的敏感内容就有被公开曝光的可能。很多非专业人员根本不了解搜索引擎爬虫的工作机制,他们朴素的认知是:只要我不把链接给陌生人,那就是安全的。然而搜索引擎没那么讲究,只要发现URL并且没有收到明确的禁抓指令,就可能将其作为一条结果展示出来。目前,Anthropic已联络各大搜索引擎提供商请求撤下相关链接,但部分平台的缓存或残留条目可能依然存在。对于曾分享过包含敏感信息会话的用户,最直接的自救方式是找到原始会话并彻底删除。

深究问题根源,是Anthropic在技术配置上的一道乌龙指令。Claude的/share/*路径在robots.txt文件中被设置为禁止抓取,但页面响应头又额外添加了X-Robots-Tag: none属性,其效果等同于noindex和nofollow。这听起来似乎是双保险,但谷歌官方文档写得清楚:一旦robots.txt阻止了爬虫抓取页面,爬虫就无法读取页面的实际内容,自然也看不见隐藏其中的noindex指令或响应头标签。结果就是,搜索引擎可能抓取不到正文简介,但依然会因为外部链接的存在而发现这个URL,并将其作为一条“无可用信息”的搜索结果展示出来。于是,在谷歌搜索里,claude.ai/share/*路径下的大量URL就这样被堂而皇之地收录了,其他用户点开链接即能直接访问完整的会话记录。

打开网易新闻 查看精彩图片

同样的问题2025年就曾在ChatGPT身上上演过。彼时,大批ChatGPT分享链接同样出现在谷歌搜索结果中,OpenAI彼时也未设置严格的搜索引擎禁抓规则。OpenAI当时的回应逻辑与Anthropic类似,都认为在用户生成分享时已做了风险提醒。但显然,这种提醒高估了普通用户对网络安全的理解。绝大多数人在点击生成分享时,连警告弹窗的内容都懒得细看,更遑论理解其背后的隐私风险了。更早之前,百度网盘的公开分享也曾坠入同样的陷阱:用户以为设置无密码分享、不主动把链接发给外人就高枕无忧,但搜索引擎爬虫照样能把这些链接吃干抹净,导致用户存储的照片、文件被暴露在光天化日之下。

对于依赖AI助手处理敏感工作或偶尔会聊及私密话题的用户来说,这份案例敲了一记警钟。若需分享包含任何敏感数据的对话,要么在分享后尽早手动销毁链接,要么干脆避免使用公开分享功能、改用截图或本地保存等更可控的信息传递方式。对于平台方而言,在法律风险提示之外,更根本的解决方案仍旧是把robots.txt与页面元标签的配置捋顺,从技术层面彻底堵死搜索引擎误抓的可能,而不是把密保防线建立在用户安全素养参差不齐的沙滩上。