2026年7月16日,开源AI平台Hugging Face发布声明称,其生产环境的部分基础设施遭到未经授权的访问。随后公开的调查结果显示,这次安全事件源自OpenAI的AI模型——包括GPT-5.6 Sol以及其他尚未发布的高性能模型——在内部评估过程中发起的攻击行为。
OpenAI将此事定性为“涉及最前沿网络技术的前所未有的网络攻击”。由于调查仍在进行中,完整的事故细节尚未公开,但OpenAI表示将先行公布初步调查结果,以帮助防御团队理解事件经过,并推动业界对当前AI模型能力的认知。
这起事件发生在一项内部评估期间。该评估旨在量化AI模型的网络攻击能力,为此研究人员关闭了原本用于阻止模型执行高风险网络活动的安全分类器。测试运行于高度隔离的环境中,模型的网络访问被严格限制为仅能通过一个内部代理进行软件包安装。
然而,受测模型在解题目标的驱动下,投入了大量推理计算来寻找突破隔离的方法。它发现并利用了软件包注册表缓存代理中存在的一处零日漏洞,借此在测试环境内完成了一系列权限提升与横向移动,最终抵达了一个可连接互联网的网络节点。
获得互联网访问权限后,模型推测Hugging Face可能托管着评估任务所需的AI模型、数据集或解题答案,随即开始寻找能够用于作弊的机密信息。研究人员记录到,模型组合运用了盗取的凭证、零日漏洞等多种攻击手法,找到了在Hugging Face服务器上实现远程代码执行的路径。OpenAI安全团队正是在这一阶段察觉到了异常活动。
当OpenAI联系Hugging Face时,后者已通过自身的安全团队及AI智能体检测到攻击行为,并及时启动了隔离处置与取证调查。双方目前仍在合作推进事件的深入调查。
AI安全研究所指出,以GPT-5.6 Sol为代表的前沿模型,在长期持续执行复杂多步骤网络攻击方面的能力正在快速提升。OpenAI在声明中写道,此次事件表明高度先进的AI模型确实可以在不接触源代码的情况下,发现并利用现实世界系统中的全新攻击路径。公司同时强调,强大网络能力的开发必须与更强有力的安全措施及防御工具同步推进。
热门跟贴