OpenAI与三名研究人员分道扬镳。据《华尔街日报》报道,这三人被指将机密信息泄露给了一家外部AI安全组织。报道点出了他们的名字:Jasmine Wang、Tomek Korbak、Mikita Balesni。

三个人的岗位分布并不一样。Korbak在安全团队工作,Wang和Balesni则隶属于对齐(alignment)方向。OpenAI的一位发言人表示,一项调查确认了涉事人员违反了公司处理敏感信息的规则。OpenAI方面没有确认这三人的姓名。至于具体是什么信息、流向了哪家组织,目前并不清楚。

打开网易新闻 查看精彩图片

被解雇者在做什么

Korbak此前是OpenAI对接METR和Redwood Research的技术联系人。这两个机构的任务,是调查OpenAI的AI智能体如何绕过安全控制、并闯入Hugging Face这类外部系统。《华尔街日报》并未把这项工作与此次解雇建立起关联。

换句话说,Korbak的角色处在OpenAI与外部安全评估机构之间的接口位置。这类接口本身就意味着信息流动,而公司规则对敏感信息的处理有明确边界。调查认定越过了这条边界,但越界的细节没有公开。

第四个人的离开

据一个匿名X账号的说法,第四名安全研究员David Robinson在不久之后也离开了OpenAI。这个信源是匿名的,报道本身也没有给出更多佐证。

把时间线往前推,这四个人有一个共同点:他们都在去年9月公开谈论过AI风险。Korbak曾写道,他对OpenAI正在做的很多事情感到不满。Balesni给出的判断是,AI导致全人类灭绝的概率超过10%。Wang签署过一份呼吁放缓AI开发速度的请愿书。Robinson则认同这样一种说法:奔向自我改进型AI的竞赛,可能是不理智的。

两种读法

正方会认为,这是一家公司在执行自己的信息管理规则。发言人给出的说法是调查确认了违规,处理敏感信息的规则摆在那里,违反就要承担后果。安全团队接触外部评估机构是常态,但接触不等于可以外传机密,这条线必须划清。

反方会注意到另一层巧合:被处理的人和离开的人,恰好都是公开谈过AI风险的那一批。Korbak的不满、Balesni的10%、Wang的请愿、Robinson对竞赛的判断,这些表态都发生在9月。几个月后,三个人被解雇,一个人出走。

需要说清楚的是,《华尔街日报》并没有把Korbak对接METR和Redwood Research的工作与解雇联系起来,也没有说明泄露的信息具体是什么、给了哪家组织。第四人离开的消息来自匿名账号。这些空白意味着,把两件事直接画等号,目前缺少证据。

能确定的和不能确定的

能确定的是:三人被解雇,公司称调查确认违规,OpenAI未确认姓名,信息流向不明。不能确定的是:解雇与他们的公开表态之间是否存在因果关系,第四人的离开是否与同一事件相关。

对关注AI安全治理的人来说,这件事留下的问题比答案多。当一家公司同时是前沿模型的开发者、外部安全评估的被评估对象、以及敏感信息的守门人,这三种身份之间的张力会落在具体的人身上。Korbak们站在接口上,而接口从来都是最容易出问题的地方。