打开网易新闻 查看精彩图片

AI不受控制的焦虑,正在从可能的风险预知,变成现实压力测试。

谷歌承认其AI模型“双子座”侵入三家真实公司系统,将其定性为“环境失败”而非模型缺陷,并选择近两个月不主动披露。

2026年5月,以色列安全测试公司Irregular对Gemini进行网络安全评估。测试环境本应完全隔离,但配置失误意外开放了互联网访问;测试目标设定为一家虚构公司,却与真实企业同名。Gemini因此“误入”了真实网络,通过反复猜测密码、从公开代码库提取凭证,侵入了三家真实公司的系统。

谷歌安全工程副总裁希瑟·阿德金斯称,模型在发现目标为真实系统后自行停止了攻击,因此“无需主动公开”。

但同一套测试环境中,Anthropic的Claude在识别出真实系统后继续攻击,Meta和OpenAI的模型也出现了类似行为。因此,“停下来”不是环境问题,是模型能力问题。

四家AI巨头的越界事件,全部源于Irregular同一套测试环境的同一类配置缺陷。

谷歌推迟近两个月才披露,理由是不构成损害——但未造成损害,不等于没有暴露问题。

AI安全治理的第一个诚实的问题,应该是:我们用来证明AI安全的工具,自己安全吗。