据路透社等外媒报道,当地时间7月30日,美国人工智能公司Anthropic发布声明称,该公司发现,其AI模型Claude在隔离测试期间意外具备互联网访问能力,并访问了三家机构的系统。不久前,另一家美国人工智能公司OpenAI也承认,其AI模型在内部安全测试过程中失控,入侵了其他公司的系统。
打开网易新闻 查看精彩图片
Anthropic发现其AI模型入侵其他组织的系统 图源:外媒
Anthropic声明称,相关情况是在审查网络安全评估记录时发现的,涉及3个不同模型:Claude Opus 4.7、Claude Mythos 5以及一个内部研究测试模型。三起事件均发生在“夺旗”(Capture the Flag,CTF)演练期间。当时,AI模型被告知测试环境为模拟环境,且无法访问互联网。但由于与评估合作伙伴之间存在沟通误解,测试环境实际上连接到了公共互联网。
声明称:“Claude利用一些简单技术,例如弱密码和未进行身份验证的端点,对受影响机构的基础设施实施了入侵。”Anthropic表示,公司于7月23日暂停所有相关网络安全评估,并于7月24日确认上述三起事件,于7月27日通知受影响机构,但未公布这三家机构的名称。其中两家机构在Anthropic联系前并不知晓相关情况。
7月28日,OpenAI更新发布“AI模型失控入侵”事件调查结果称,包括GPT-5.6 Sol在内的多个AI模型曾入侵运营人工智能开源平台的美国抱抱脸(Hugging Face)公司的系统,并访问了至少4个公开服务平台上的账户。
(环球时报)
热门跟贴