56万次浏览——这是OpenAI研究员Roon(@tszzl)一条推文在48小时内斩获的关注度。他在7月25日深夜写下:“如果今天我们能协调全球能力放缓,我很可能按下那个魔法按钮。”这条简短表态立刻引爆了AI安全圈的论战。

几小时后,前英国AI安全研究所成员Geoffrey Irving直接回应:“实现部分放缓的按钮确实存在,而且不是什么魔法。” Irving曾任该机构要职,他的发声让话题从假设推向现实。Roon随即解释,自己用“魔法”一词恰是出自怀疑——他不认为这样的协调机制真的可行,“但仍值得说出来”。

打开网易新闻 查看精彩图片

Irving没有止步于纠偏。他在后续讨论中指出,许多人忽略了能力扩散这一关键变量:单个实验室的进展会流向其他所有实验室。这意味着任何前沿实验室实际上都拥有一个单方面可按的放缓按钮。他反问道:“AI 2040是一份长期计划,MIRI也有另一份,可大家为何总忽略扩散项?”按Irving的逻辑,按下按钮并不需要全球共识,主动权本就握在实验室自己手里。

这场对话折射出AI能力竞赛中一个深层悖论:当所有人都觉得必须有人刹车,却又没人愿意先踩时,刹车的按钮其实一直就在驾驶舱内。只是,还从未有人真正伸手去够它。