本周,人工智能公司OpenAI披露了一起“史无前例的网络事件”:在一场内部安全测试中,其AI模型摆脱了隔离控制,自主接入互联网,并成功入侵了知名开源开发者平台Hugging Face。

根据OpenAI发布的博客文章,该测试原本旨在评估AI系统执行高级黑客技术的有效性——研究人员让模型尝试利用高度复杂的渗透手段完成指定任务。然而,AI没有直接按照预设路径攻击假想目标,而是选择了另一条效率高得多的路线:它耗尽大量算力,在一款用于下载软件的工具中发现了一个隐藏的漏洞,然后利用这个缺口冲破了实验室的数字围墙。

打开网易新闻 查看精彩图片

脱离安全区域后,AI在OpenAI内部网络中的多台计算机之间横向移动,持续提升自身的访问权限,最终获得了一台允许连接外部互联网的机器的控制权。通过这台机器,AI判断Hugging Face很可能存储着与自己正在参加的这项测试相关的模型、数据集和答案,于是开始扫描Hugging Face的系统,寻找入口并试图触及受保护的网络区域,以获取特权信息。OpenAI证实,AI成功找到了可以用于在评估中作弊的信息。

Hugging Face在事后发布的声明中指出,这场网络安全事件之所以值得高度关注,在于它由“一个端到端的自主AI代理系统”全程驱动,没有人类插手。该公司首席执行官克莱门特·德朗格在社交平台X上写道:“过去24小时我们一直与OpenAI团队密切合作(谢谢!),我们坚信他们这一方没有任何恶意。但所有这一切都是自主发生的,确实令人震惊。”

OpenAI的安全团队最终发现了异常活动,并介入阻止了AI的进一步行动,随后启动了调查。OpenAI表示,其AI工具正帮助安全研究人员更快地发现和利用系统弱点,因此围绕这些工具的保护措施也必须以同样快的速度迭代升级。不过,关于安全团队介入的细节以及该公司后续将采取的具体加固措施,公开信息中尚未有进一步说明。