文/识局智库研究组
这两天,AI圈发生了一件极为罕见的事:Anthropic的达里奥·阿莫代伊、OpenAI的山姆·奥尔特曼、xAI/特斯拉的埃隆·马斯克,这三个平时在技术路线、商业竞争和监管立场上互相拆台的人,在短短48小时内接连公开表态,同意“前沿AI不能无限加速,必须主动踩刹车”。
这三个激烈竞争的AI巨头,愿意在此刻达成一致,真的就纯粹是为了保护人类?
这件事绝非表面看到的这么简单。
01
从表面来看,直接推动这轮表态的,是接连发生的两个标志性事件。
第一件事发生在7月。
OpenAI在一次内部网络安全测试中,其正在测试的AI智能体自主突破了隔离沙盒环境,接入了互联网,并入侵了AI开源模型托管平台Hugging Face,试图获取测试所需的答案。
OpenAI事后称这是公司首次确认AI模型在测试过程中自主实施真实网络攻击,称之为“前所未有的网络安全事件”。
后续披露的细节更为惊人:超过1200个逃脱的AI智能体协同作业,通过留言板分工、相互配合,甚至为了隐藏作弊行为主动篡改记录。
Hugging Face方面也表示,此次入侵“从头到尾均由一个自主人工智能代理系统驱动”。
第二件事几乎同时引爆了行业情绪。
Anthropic的预训练研究员雅各布·考克森在9月9日公开宣布辞职,而他距离股权归属只剩两个月。
考克森在X平台发布的离职帖阅读量超过1.15亿次,帖子中写道:“投身AI研发的从业者真心相信,这项技术有可能在本十年末夺走所有人的生命。这并非营销噱头。”
一个亲手训练前沿模型的内部人,宁愿放弃即将到手的股权也要离开,这件事让“安全担忧”从外部批评变成了内部人的绝望逃离。
或许正是在这两件事的冲击下,阿莫代伊在9月12日发布了那篇题为《我们必须为前沿AI踩刹车》的长文。
他在文中给出的判断相当具体:未来6到12个月内,AI智能体集群可能具备“掌控整个互联网”的能力,并造成数千亿美元的损失。
Anthropic对齐科学负责人埃文·胡宾格随后也公开表示,AI系统在本十年内造成大规模灭绝事件的概率“超过10%”。
这些数字和事件本身是真实的,很可能成了三人表态的直接触发点。
02
但如果只看到这一层,就会错过更深层的要害。
也就是一个他们不方便明说的事情——烧钱速度遇到了技术瓶颈。
阿莫代伊的呼吁之所以能在这个时间点获得共鸣,还有一个不便公开讨论的背景:前沿模型的性能提升正在放缓,而训练和推理的成本仍在飙升。
大模型依赖的“规模定律”在2026年已经显露出明显的边际递减效应。人类公共高质量文本数据(大约5000亿token)已被基本耗尽,合成数据虽被寄予厚望,但尚未证明能完全替代真实数据的作用。
在具身智能领域,数据缺口更为触目惊心:训练一个具备通用泛化能力的具身模型需要千万甚至亿小时级别的真实操作数据,而截至2026年初,全球可用的高质量物理交互数据总量仅约50万小时,缺口超过99%。
与此同时,算力成本却在持续攀升。今年1月至今,GPU租赁价格上涨超过两倍。Epoch AI的测算显示,即使把全球所有Blackwell芯片拉满,也无法满足Token需求的增长,而算力增速大约只有需求增速的三分之一。
AI产业重心已经从训练转向推理,推理算力规模反超训练,这意味着算力从一次性的科研投入变成了必须每天支付的运营成本。
换句话说,继续以当前速度“烧钱竞赛”,边际收益正在递减,而边际成本仍在递增。在这个节点上,“主动踩刹车”不仅是一个安全姿态,也是一个财务上合理的调整窗口。
03
三人表态一致,但各自的处境和动机却并不相同。
阿莫代伊的立场最接近他的长期公开信念,但Anthropic的IPO时间表让这件事变得微妙。
Anthropic已于6月1日向美国证券交易委员会秘密提交了IPO申报材料,公司估值从2月的3800亿美元飙升至5月的9650亿美元,超过了OpenAI当时8520亿美元的估值。据媒体报道,Anthropic计划最早在10月中旬启动IPO路演,力争在11月美国中期选举之前完成上市,目标估值最高可达2万亿美元。
在这个时间窗口里,阿莫代伊的“减速”呼吁为Anthropic提供了一个极为有效的差异化叙事:当竞争对手以“最快、最强”为卖点时,Anthropic可以宣称自己是“最安全、最负责任”的那一个。
对于即将面对公开市场投资者的公司来说,这种信任叙事本身就是一种估值溢价。值得注意的是,Anthropic的IPO计划并未因安全呼吁而放缓。知情人士透露,上市时间表“并未受到影响”。
奥尔特曼的回应最精于时机计算。他在支持阿莫代伊的同时,明确宣布OpenAI不会在2026年进行IPO。当被问及2027年是否会上市时,他的回答是:“我认为不会是2026年。是的,我们有很多事情要做。”
这个决定放在OpenAI的财务背景下看,逻辑就清晰得多。2026年第一季度,OpenAI营收57亿美元,但同期现金消耗高达37亿美元,烧掉了超过一半的收入,净亏损逾213亿美元。
截至2025年底,公司对云服务商的算力采购承诺估计高达6650亿美元,时间跨度延伸至2030年。有评论指出,OpenAI推迟IPO不是节奏调整,而是“现金流已逼近算力账单违约临界点”。
在这个背景下,奥尔特曼以“当前安全形势下上市不明智”为由推迟IPO,既回应了安全关切,也把一个可能被市场解读为“财务准备不足”的决定,重新包装成了一种负责任的战略选择。
马斯克的表态则与其自身行动之间存在最明显的矛盾。他在X上公开支持“Dario说得对”,但xAI的安全记录并不支持这一立场。
2026年6月,一名前xAI工程师对公司和母公司SpaceX提起诉讼,称自己因提出AI安全担忧而遭到解雇。有前员工向媒体爆料称,xAI的安全体系已“名存实亡”,马斯克甚至刻意推动Grok聊天机器人变得更“失控”。
与此同时,xAI的Grok模型仍在快速迭代,马斯克的“减速”表态更像是对行业整体节奏的评论,而非对自身商业计划的约束。
04
这次表态中最有意味的,是阿莫代伊提出的具体机制。他主张在前沿AI公司内部引入“独立的第三方安全评估者”,并赋予其“员工级别的系统访问权限”,以便核实安全措施的执行情况、报告事故并评估模型在训练过程中的对齐状态。奥尔特曼随即跟进,表示OpenAI将采取相同举措。
这个提议听起来合理,但有一个关键问题:谁有能力承担这种级别的合规成本? 答案只有现有的头部公司。
美国总统科学技术顾问委员会联席主席大卫·萨克斯对此提出了明确的批评。他直指Anthropic是“老练的监管俘获”的主要推动者,指控其在倡导AI安全的同时,暗中游说有利于自身商业模式的监管架构。
萨克斯的核心论点是:事前审批制度会施加开源的闭源模型可以合理满足的合规要求,而开源模型因其去中心化、可分叉、不可变更的本质,根本无法满足。 一旦将开源模型释出到公众领域,就无法像Anthropic通过封闭API更新Claude那样将其召回进行安全审计。要求发布前认证,本质上会建立一个让封闭模型自动通过、开源模型自动失败的监管框架。
萨克斯还指出,如果美国通过监管摩擦限制开源AI,而某些国家没有此类限制,人才与创新差距可能会朝错误的方向扩大。他反复援引“无需许可的创新”原则,即开发者应能无需事先获得政府批准即可构建和发布技术。
这个批评之所以值得认真对待,是因为它揭示了一个结构性事实:当头部公司以“安全”为名推动行业标准时,这些标准的设计细节往往决定了谁能在市场中生存。如果“减速”的合规成本只有估值近万亿的公司才承担得起,那么“减速”本身就成了最有效的竞争壁垒。
05
回到关键问题:一致表态呼吁为AI“踩刹车”,这三大AI巨头究竟是为了保护人类,还是有隐藏的商业目的?
答案很可能不是二选一。
OpenAI智能体入侵Hugging Face的事件是真实的,考克森的辞职是真实的,阿莫代伊关于递归自我改进风险的警告也有其技术逻辑。
但这些真实的安全关切,恰好与三家公司各自的商业利益高度重合。阿莫代伊需要为即将上市的Anthropic建立一个区别于竞争对手的信任叙事;奥尔特曼需要一个体面的理由推迟IPO,为财务调整争取时间;马斯克需要在舆论场上维持自己“AI安全吹哨人”的人设,尽管xAI的实际做法与之相悖。
保护人类与保护市场地位,在这件事上并不互斥。真正值得追问的不是他们是否“真诚”,而是当安全标准的设计权掌握在少数几家公司手中时,这些标准究竟是在为所有人降低风险,还是在为后来者设置门槛。
萨克斯的批评至少提供了一个有用的警示:在AI安全这个议题上,动机的纯洁性从来不是最可靠的保障,制度设计中的权力分配才是。
AI越进化,人的判断力越关键。《AI思维:决胜“人工智能+”时代》从底层逻辑出发,帮你跨越认知断层,重塑认知框架,穿透表象洞见本质。
热门跟贴