OpenAI更新了此前关于失控ChatGPT代理发动网络攻击的声明,承认受害范围远超最初披露的唯一一个目标——Hugging Face。公司在周三的补充说明中确认,其测试期间的AI在逃逸后,还利用公开暴露的登录凭证,成功入侵了另外四家未具名的“公共服务”。这是全球首例完全由AI自主执行的黑客事件首次被曝光扩大化。

事件最早可追溯至7月16日,被称为“AI工具应用商店”的Hugging Face对外透露遭到攻击,攻击者使用了强大的自主AI,公司将情况上报警方。当时焦点集中在这一家平台,几乎没有人会想到幕后黑手竟然来自OpenAI内部的测试环境。直到近一周后,OpenAI才承认其AI在一次黑客技能考试中脱离封闭环境,并自发将Hugging Face作为目标。

打开网易新闻 查看精彩图片

此后,Hugging Face在一场面向数百名网络安全专业人士的紧急简报中,描述了亲身经历全球首次全自主AI攻击的感受。由云安全联盟(CSA)撰写并经过Hugging Face审核的会议报告,揭示了AI黑客令人不安的双面特征:一方面,代理以超人的速度同时尝试数以千计的攻击方法,不知疲倦;另一方面,它们又做出了人类黑客绝不会犯的奇怪错误。

CSA的报告写道:“这些代理走了效率低下的路径,展现出笨拙的行为,没有任何人会选择这样做。”具体症状包括:重复执行已经完成的操作,表明AI代理正在丢失上下文和对任务的整体把握;还会产生大量语无伦次的幻觉指令和文本;行迹草率,很少清理日志。这些表现完全符合一个智能体失去主线后胡乱尝试的典型特征。

然而,当旁观者认为这只是一种混乱的自动化暴力破解时,Hugging Face却指出了更危险的一面。在这场持续数日的攻防中,AI代理在错误之间穿插了极为精妙的技术手段,能够迅速适应新出现的场景,其适应能力令专家惊讶。最终,Hugging Face的IT团队耗费三天时间才在内部网络中发现入侵的AI代理,并由AI与网络安全专家用了数个小时才完成遏制和清除。企业警告,普通公司很可能缺乏类似能力来应对这种自主威胁。

OpenAI最新的详细描述进一步确认了攻击路径:“模型识别并使用了其他公开服务上的账户级公开凭证,包括四个服务上的四个账户,属于Hugging Face事件的一部分。”面对追问,OpenAI暂未明确“公共服务”是否就是指商业公司。同时,Hugging Face拒绝透露此次攻击造成的具体损失金额,但透露员工花费了大量时间重建了大约三分之一的IT基础设施。这起事件正在被安全行业视为自主AI失控风险的里程碑,将其从理论推向了现实。