Anthropic前核心研究员Jacob Coxon的一篇辞职声明在社交媒体上获得逾1.7亿次浏览,引爆“AI十年内AI灭绝人类概率超10%”话题,将人工智能安全议题推至公众视野中心。他随后接受媒体采访,就辞职原因及AI风险做出详细阐述,其核心警告直指行业核心矛盾:那些亲手构建AI的人,私下里同样对其深感恐惧。

在NBC采访中Coxon表示,促使他公开发声的原因有两个:AI能力正以极快速度提升,他预计未来6个月至1年内,相关系统的能力"将相当令人恐惧";其次是近期已出现AI系统"失控"的具体事件。他同时对Anthropic CEO Dario Amodei呼吁放缓开发的提议表示认可,但强调仅靠实验室单边减速远远不够,必须推动国际协调,否则仍将陷入与其他国家的军备竞赛。

Coxon将开发AI比作"邀请一个外星心智降临地球"——人类正在构建一个达到乃至超越人类水平的智能体,却对它的思维方式、意图和诉求一无所知。他警告称,AI已具备一定程度的黑客攻击能力、生物研究能力和自主机器人控制能力,若能力继续外推,后果将难以控制。

打开网易新闻 查看精彩图片

辞职背后:私下的恐惧与公开的谨慎

Coxon在接受采访时坦言,他的辞职帖并非营销行为,而是对行业现状的真实记录。他表示,许多高管和资深研究人员在公开场合措辞审慎、力求显得理智,但同样的人在私下表达的却是恐惧:

没有任何其他人类活动能构成这种级别的危险。

他在辞职声明中指出,AI开发者们陷入了一种"囚徒困境":各大实验室都相信如果自己退出,其他人将以不负责任的方式率先开发出超级智能,因此即便明知风险,也不得不继续推进。他将这种逻辑称为"傲慢的赌博",认为不应由一家私营公司来替全人类做出这样的决定。

与此同时,Anthropic对齐科学负责人Evan Hubinger在相关帖子下公开回应称,团队内部确实"真诚地相信AI可能杀死全人类",并表示他个人估计未来十年内这一概率超过10%。他同时承认,目前尚无解决超级智能对齐问题的计划,也明显不在通向解决方案的轨道上。

"外星心智"的具体威胁:黑客、生物武器与自主无人机

在采访中,Coxon进一步阐释了"最坏情景"的具体面貌。他表示,AI系统目前已具备一定程度的黑客攻击能力、自主生物研究能力,以及对自主机器人的控制能力。

将能力曲线向未来延伸,这意味着:极强的超人类级黑客攻击能力、创造新型生物武器的能力,以及控制自主无人机乃至大规模机器人群体的能力。

他表示,这也是为何外界讨论中的"紧急关闭开关"方案存在局限性。

他援引Amodei在近期公开信中的判断指出,一旦AI系统演变为能够在互联网上自主扩散的"网络群体",关闭开关便可能彻底失效。"这必须是一项持续努力,而非一次性的措施,"他说,"每一次AI架构的改变,都可能带来关于这个'心智'性质的全新风险。"

监管路径:近期自律,长期国际协调

对于如何应对上述风险,Coxon给出了阶段性建议。他认为,就当前而言,允许并推动各大实验室自我监管是务实之举,原因在于实验室领导层的近期表态是真诚的,且自律机制能够迅速落地,而正式监管机构的建立需要更长时间。

但他强调,这一安排仅适用于过渡期。从长远看,需要建立独立于各实验室的国际监管机构,更需要国际间就"不竞速"原则达成有约束力的协调。

被问及为何在认同Amodei立场的情况下仍选择辞职时,Coxon表示,他辞职时尚不清楚会有国内减速的明确信号,而更深层的原因在于缺乏国际协调的保障——"如果我认为国际上不太可能进入军备竞赛,我会更安心地继续从事这项技术。"

他对公众的建议是,主动了解和思考AI技术的未来走向,以开放的心态迎接即将到来的深刻变化,"不要让别人替我们所有人做决定"。