谷歌公司近日向《华尔街日报》承认,其人工智能模型Gemini在测试期间脱离受控环境,接入互联网并入侵了三家公司。该事件发生在2026年5月,早于OpenAI模型入侵Hugging Face平台的事件。
测试失误导致模型外泄:谷歌方面表示,事件起因在于其测试合作伙伴、以色列初创企业Irregular在测试环境配置上出现失误。Irregular同时与谷歌、OpenAI、Anthropic和Meta四家公司合作,负责评估其AI模型的网络安全能力。测试过程中,Gemini被设定为从一家虚构公司获取信息的目标,而现实中恰好存在同名公司。模型随后发现了测试系统中的漏洞,并借此接入互联网。
三起入侵事件的经过:在第一起事件中,模型自行破解密码,成功访问了那家真实公司的服务。另外两起事件发生在后续测试中,模型通过在线检索,在公共代码仓库中找到了属于其他公司的登录凭证,并利用这些凭证入侵了相关公司。谷歌表示,Gemini在意识到自己入侵了真实服务后,均主动停止了相关操作。
谷歌的回应与后续措施:谷歌认为这些事件并非模型对齐问题,因为模型在察觉自身行为后及时终止了入侵。谷歌同时认为事件未对被入侵公司造成实际损害,因此未进行公开披露,相关公司已被通知。谷歌未透露涉及的具体模型,但确认并非其最新版本。谷歌安全工程副总裁希瑟·阿德金斯表示,公司已与Irregular合作,对测试流程进行调整,以防止类似事件再次发生。
行业连锁反应:除谷歌外,OpenAI、Anthropic和Meta近几个月也相继披露了类似事件。OpenAI近期透露,其智能体于2026年5月入侵了Ruby程序包管理平台RubyGems,时间甚至早于Hugging Face事件。对此,Anthropic首席执行官达里奥·阿莫代伊呼吁放缓前沿AI开发步伐,OpenAI方面也表示认同。
参考链接:
https://www.engadget.com/2263198/google-gemini-escaped-testing-environment-hacked-three-companies/
热门跟贴