如果你用过 DeepSeek 的“分享”功能,把一段看似无关紧要的 AI 对话链接发给同事或朋友,可能以为这就像发出一条不可搜索的私密链接——只有持有链接的人能看到。但一次安全研究人员的发现打破了这种预期:谷歌正在主动收录这些分享链接,使原本“仅通过链接查可看”的对话,直接暴露在公开搜索中。
研究人员在进行日常开源情报收集时,用了一个最简单的搜索指令:site:chat.deepseek.com/share。搜索结果页面立刻跳出一排可直接点击的 DeepSeek 对话链接,格式规律,例如“https://chat.deepseek.com/share/95z1fr6y7rj4q5nmd0”。这些不是截图,而是实时、完整渲染的聊天会话,任何人只要在谷歌里敲下那个 site: 指令就能打开。
DeepSeek 并不是一声不吭地制造风险。当你点击“分享”时,界面会弹出清晰提示:“创建公开链接”,并警告“任何有链接的人都可以查看你分享的对话。请检查是否包含敏感或隐私内容。你可以随时在‘设置-数据’中管理已分享的链接。”这条提示建立了知情同意,提醒用户自我审查。但问题在于,“任何有链接的人”和“任何会用搜索引擎的人”之间存在巨大的认知差异。
多数用户理解的“分享链接”是一种半私密行为,类似把未上架到公开列表的 YouTube 视频链接发给特定人,或者把私有代码片段链接发给合作者。在他们的心理模型里,“只有我发送链接的那个人能看见”。可一旦谷歌爬虫抓取并索引了这个 URL,对话就不再是“分享给一个朋友”,而是发布到了开放互联网上,被缓存、存档,还可能被第三方数据集抓取。
AI 聊天会话早已不是简单的问答交流。它们变成了开发者的集成开发环境延伸、心理咨询的谈话记录、法律笔记草稿、系统管理终端。用户会在与 LLM 的对话中粘贴出绝不可能发到 Stack Overflow 或公开推文里的内容。研究人员列出了一系列已经实际出现在搜索结果里的内容:API 密钥、明文密码、专有源代码、医疗记录、个人证件文件,以及其他一旦暴露就难以挽回的敏感数据。
一旦被索引,这类数据就进入了开源情报的长尾。即便用户事后删除了分享链接,或者 DeepSeek 移除了该条目,对应的 URL 仍可能残留在谷歌缓存(可通过 cache: 操作符访问),留存在互联网档案馆(archive.org),出现在被动 DNS 和 URL 扫描服务(如 URLScan、VirusTotal)的记录里,甚至被训练 AI 模型的数据爬虫批量抓取。出于私密目的粘贴进聊天框的那些内容,可能正安静地躺在某台服务器的备份中,随时等待另一次搜索指令被唤醒。
热门跟贴