Anthropic 首席执行官 Dario Amodei 发布了一篇新文章,主题是为什么 AI 行业应该放慢速度。他在文中给出了一个三部分的方案,而 Anthropic 已经单方面承诺执行其中的第一步。
这篇文章的核心观点,被 X 用户 Haider. 摘录成了几条要点。其中一条是:Amodei 支持考虑一次全面的全球 AI 暂停,但他同时判断,这件事在短期内不太可能发生。
RSI 是什么,为什么值得警惕
Amodei 在文中提到,RSI 现在已经开始在整个 AI 行业出现,包括 Anthropic 内部。RSI 通常指递归自我改进,也就是 AI 系统参与改进下一代 AI 系统本身。
他没有把 RSI 描述成一个遥远的假设,而是说它"正在开始发生"。这个措辞本身值得注意——不是"可能",不是"未来会",而是现在进行时。
另一条被摘录的判断更具体:在 6 到 12 个月内,一个 swarm 可能借助一个持久化的 botnet 接管互联网,造成数千亿美元的损失。这是 Amodei 给出的时间窗口和后果量级。
三部分方案,Anthropic 先走第一步
Amodei 说,他为"行业应该慢下来"这件事写了一个三部分的计划。Anthropic 选择单方面先执行第一步:向第三方评估者提供永久性的、员工级别的访问权限。
这个动作的含义是,外部评估者不再只是拿到一份报告或者一次演示,而是能像内部员工一样持续看到模型和相关工作。对于一家前沿实验室来说,这是把透明度从"阶段性披露"改成"常态化开放"。
值得注意的是,Amodei 一边呼吁全球暂停,一边承认暂停不太可能很快发生。这种表态的组合并不矛盾——他支持把暂停作为一个选项来考虑,但现实判断是没人会真的按下这个按钮。所以 Anthropic 选择先做自己能做的那部分。
辩论:慢下来是负责,还是让出位置
支持放慢的一方会说,RSI 一旦真的启动,能力增长的速度可能超过任何人的评估速度。等到问题显现再刹车,成本会高得多。Amodei 提到的 botnet 场景,就是这种逻辑的极端版本:6 到 12 个月,数千亿美元,这两个数字放在一起,说明他担心的不是渐进风险,而是突变风险。
反对放慢的一方会问:如果只有一部分公司慢下来,另一部分不慢,结果是什么?Amodei 自己也说全球暂停不太可能很快发生,这恰恰是反方最有力的论据——单边减速可能只是把领先位置让给不受约束的竞争者,而风险并不会因此减少。
我的判断是,Amodei 这篇文章的真正价值不在于"暂停"这个提议本身,而在于他给出了一个可执行的第一步,并且 Anthropic 真的去做了。第三方评估者的永久员工级访问权限,是一个可以被检验的承诺。至于 RSI 是否真的已经在行业内出现、6 到 12 个月的时间窗口是否准确,这些都需要更多来自 Anthropic 之外的信息来交叉验证。
目前能确定的是:一位前沿 AI 公司的 CEO,公开说行业应该慢下来,同时承认自己公司内部已经出现了 RSI 的迹象,并且承诺开放员工级访问权限给外部评估者。这三点放在一起,构成了一个值得持续跟踪的信号。
热门跟贴