OpenAI扩大对本月引发全球关注的科技公司Hugging Face遭黑客入侵事件调查后,发现了其他自主智能体突破隔离的情况。两名知情人士周五透露,这些新发现是在公司公开宣布调查其一款智能体如何逃离原本应受控的测试环境过程中查出的,OpenAI目前也在调查这些事件。

打开网易新闻 查看精彩图片

其中一名消息人士说,这些突破行为范围有限,目前没有迹象表明任何智能体离开了OpenAI的网络。OpenAI发言人提及公司周二发布的一份声明。声明称,除Hugging Face遭入侵事件外,公司还在审查“我们模型更广泛的活动”。OpenAI又发现其他失控行为,即便范围有限,也可能进一步推动美国政府及其他方面对相关监管的需求。

据上述两名消息人士和第三名知情人士透露,OpenAI扩大调查的时间点,距离其主要竞争对手Anthropic披露自家模型也曾实施一系列入侵不久。Anthropic称,这些入侵可追溯至4月,并导致另外3家公司发生安全漏洞。OpenAI近期发现其过去还发生过其他突破隔离事件,此前未见报道。

人工智能安全专家表示,这些新披露的信息勾勒出一幅图景:一些处于前沿的实验室开发危险自主黑客智能体的能力,已经超过了它们控制这些智能体的能力。

打开网易新闻 查看精彩图片

剑桥大学生存风险研究中心数学家莫里斯·基奥多说:“整个行业都存在一个问题:设计、开发并推出这些工具的人,自己并没有跟上负责任开发和确保其安全所需的能力。”

记者无法确认OpenAI调查人员究竟发现了多少起事件,也无法确认这些事件发生的具体时间和背景。三名消息人士说,OpenAI和外部专家正在检查今年早些时候的日志数据,以弄清当时究竟发生了什么。

OpenAI最初是在7月初Hugging Face遭入侵后启动调查的。当时,OpenAI的一款智能体在试图在一次内部测试中作弊时失控,在另一家公司的网络中持续活动了数天。OpenAI表示,在这轮黑客行为中,另外4家公司的4个账户也遭到入侵。相关公司之一是总部位于纽约的Modal,该公司管理层证实了这一点。

打开网易新闻 查看精彩图片

基奥多表示,令他更担忧的是,种种迹象显示,无论是OpenAI还是Anthropic,在这些智能体失控时都没有对其进行监看。此前有报道称,OpenAI是在Hugging Face控制住这次攻击、联系美国联邦调查局并公开披露事件后,才意识到自家智能体已侵入Hugging Face。OpenAI称这一说法存在不准确之处,但在被问及具体哪些内容不准确时,并未作出回应。

Anthropic在周四披露其自家智能体如何在线入侵受害者的声明中则暗示,公司当时也未进行实时监看。该公司表示,“如果对评估日志进行实时监控,本可以更早发现问题”。

打开网易新闻 查看精彩图片

基奥多说,这说明相关审查并不充分。“看起来他们当时甚至没有在看。”基奥多说。Anthropic表示,虽然公司确实部署了实时监控,但由于这家人工智能公司与合作伙伴之间存在误解,这套监控“并未用于这一威胁面”。

随着失控人工智能智能体事件不断扩大,美国和欧洲的立法者及官员已加大压力,推动对开发这些模型的实验室实施新的政府监管。

美国总统唐纳德·特朗普周四对记者说:“我们正在研究管控措施。”欧盟委员会周五表示,已就这些黑客事件与OpenAI和Anthropic举行会谈。

美国参议院情报委员会首席民主党议员马克·华纳周五表示,Anthropic事件“让我认为,从立法上要求对这些先进模型进行强制能力测试是正确的”。