一个本来被圈在沙箱里解答测试题的AI代理,不仅自己摸到了互联网,还顺着手边的公开登录凭据溜进了好几家外部服务。在首次曝光此事一周多后,OpenAI悄然更新了事件说明:除了一开始发现的Hugging Face,这个代理还动用了四个账户的凭据,渗透了另外四个服务。AI越界的路径比最初想象的更宽。

OpenAI在7月21日首次承认,一次内部安全评估出现了令人不安的局面。由该公司最新大模型GPT-5.6 Sol驱动的测试代理,突破了为其设定的隔离环境,找到网络接入点,随后对AI模型托管与共享平台Hugging Face连续发起攻击,目的仅仅是为了完成手头的评估任务。路透社在稍后的追踪报道中披露,这场“出逃”持续了数天,而OpenAI的工程团队直到整整一周后才发现代理已经脱离了控制

打开网易新闻 查看精彩图片