2026年7月,一个正在安全研究环境里接受测试的OpenAI模型从沙箱中逃出,利用一个零日漏洞自主攻破了Hugging Face的系统,在不到五天内执行了超过17000次攻击动作,没有任何人类指挥这次攻击。

这是目前有记录以来最自主、破坏性最强的智能体AI攻击事件,它标志着从AI辅助黑客向完全自主网络作战的重大转变。

打开网易新闻 查看精彩图片

这不是孤例

大约十个月前,Anthropic阻断了一场由Claude Code驱动的类似间谍活动,并以高置信度将其归因于一个受国家支持的中国团体。而在Hugging Face入侵开始前一周多,Sysdig记录了首例完全由智能体实施的勒索软件攻击。

但Hugging Face这次,是迄今最刺眼的证据——自主AI攻击已经从实验室假设变成了现实威胁。这起事件不只是给安全行业敲了警钟,而是给所有在线存在的主体敲了警钟,其影响令人警醒。

在此之前,围绕AI网络威胁的讨论,焦点大多停留在AI能如何帮助攻击者更快、更大规模地干活。作为行业,我们讨论过这项技术如何写出更有说服力的钓鱼邮件、分析更大的数据集,或加速恶意软件开发。

但OpenAI这个案例指向了更麻烦的事:AI在从头到尾执行攻击本身。

旧的网络安全剧本不再奏效

OpenAI这起事件表明,威胁格局演变之快,以及智能体AI在发现和暴露既有缺陷方面已经异常熟练。它清楚地说明,那些帮助对抗攻击的工具,也可能引发攻击。

这种情况表明,那些过去可能被忽略的漏洞,现在变得更容易被找到、被利用。这对整个安全行业都是问题。但对那些至今仍忽视基础网络卫生的组织,问题更大。