一名在OpenAI安全部门任职三年半后辞职的员工,把矛头对准了老东家。戴维·鲁宾森(David Robinson)在《大西洋》杂志发表文章,标题直接写着《我辞去OpenAI的工作,只因这家公司的文化已经崩坏》。
他的核心指控指向一种开发模式:先发布系统,等问题暴露后再去加固安全防护。鲁宾森称,OpenAI十分依赖这套所谓的"迭代部署"逻辑,而在他看来,这种做法远远不够谨慎。
三年半,12次前沿模型发布
鲁宾森自称参与起草过OpenAI的风险应对框架,并负责监督12次前沿模型发布对应的安全报告。这个数字构成了他批评的分量——他不是旁观者,而是流程内部的经手人。
他写道:"公司只顾着接二连三地赶进度推出新版本,却没能达到我心目中理应具备的审慎标准。"在他看来,在研发能力更强的系统之前,应当更加重视安全方面的专业人才与相关研究。
鲁宾森给出的判断很直接:"试错的时代已经结束了。"
该像核电和航空那样做安全
鲁宾森提出,先进人工智能系统所需要的防护机制,应当更接近核电与航空这类行业所采用的安全保障体系。这两个行业的共同点是:事故代价极高,因此安全验证必须前置,而不是等出事再补。
他同时发出警示:人工智能能力的发展速度,已经超过研究人员对于对齐问题的认知水平。对齐这一研究领域,致力于保证人工智能系统的行为符合人类的目标与价值观。
换句话说,能力在跑,理解在追,两者的距离正在拉大。
OpenAI的回应与行业争论
OpenAI的一名发言人在一份声明中表示:"我们一直在把控模型,避免它的能力超出我们能够安全管控的范围;一旦需要放缓节奏,我们就会暂停训练,或是暂缓模型的对外发布。"
这番言论进一步激化了人工智能行业内部的一场争论,争议焦点在于各家企业研发性能日益强大的系统时,推进的脚步是否过快。此前已经发生过多起安全管控失效或是实验性系统出现异常表现的事件,OpenAI及其竞争对手Anthropic也因此受到外界审视。
鲁宾森的批评不是孤例,但它来自一个曾经负责写安全报告的人。当内部经手人选择公开辞职并撰文,争论的性质就变了——从外部质疑,变成了内部裂痕的显影。
热门跟贴