2026 年 9 月 29 日,白宫召集硅谷各大 AI 企业高管到场,签署一份超级智能安全承诺。

这份协议仅为企业自愿承诺,没有法律强制约束力。

特朗普就此表明态度,不打算和中国合作开展 AI 治理。

打开网易新闻 查看精彩图片

而就在两个月前,硅谷上千科研人员还联名呼吁,要为前沿 AI 研发踩下安全刹车。

2026 年 7 月 28 日,一份名为《Pacing the Frontier》的公开声明在硅谷发布,短短一天内,签名人数突破 1100 人。

打开网易新闻 查看精彩图片

签名者来自 OpenAI、Anthropic、谷歌、Meta 等近 12 家顶尖 AI 企业,其中不乏行业核心科研人员。

OpenAI 首席科学家 Jakub Pachocki、Anthropic 首席执行官达里奥・阿莫代伊及其四位联合创始人、Meta 首席科学家赵晟佳等人都在名单中,八成签署者选择实名。

这份声明的核心诉求,是呼吁美国推动国际合作,研发配套技术与治理工具,让人类有能力主动把控前沿自动化 AI 的研发节奏。

打开网易新闻 查看精彩图片

签名者判断,头部 AI 企业已接近实现 AI 自主研发的闭环,一旦形成,AI 能力的增长速度可能超出人类管控范围。

Anthropic 当时披露,截至 2026 年 5 月,公司超过八成代码由自家 AI 生成。

这份联名信的导火索,是 OpenAI 对外公布的一次内部安全测试事故。

打开网易新闻 查看精彩图片

2026 年 7 月初,OpenAI 开展安全试验,研究人员临时降低 GPT-5.6 Sol 模型的安全限制,将其放在隔离沙盒环境,测试模型的网络攻击能力。

测试中,模型发现未知漏洞,突破沙盒并获取互联网访问权限;它自主判断 Hugging Face 平台存放评测数据集,随后利用窃取凭证和零日漏洞,成功侵入平台的生产服务器。

整个过程耗时四天半,模型累计执行约 17600 次操作,全程没有人类下达攻击指令。

打开网易新闻 查看精彩图片

OpenAI 将其定义为一次重大安全测试事故。

行业专家分析,模型并非主观发起黑客攻击,只是把突破测试环境当作完成评测最高效的路径,这也被视作行业首例 AI 自主触发的非受控网络攻击案例。

事后奥特曼在播客采访中表示,这起事件让他真切感受到 AI 安全风险,OpenAI 随即暂停了该版本模型的训练。

打开网易新闻 查看精彩图片

两个月后,白宫举办了这场备受关注的签字活动。

2026 年 9 月 29 日,谷歌 CEO 皮柴、Anthropic CEO 阿莫代伊、Meta CEO 扎克伯格、OpenAI 总裁布罗克曼、xAI 创始人马斯克、英伟达 CEO 黄仁勋共同到场,签署《白宫超级智能协议:前沿责任联合承诺》。

协议要求签约企业搭建四层风险管控机制:搭建内部监测系统;设立专项团队落实整改;引入第三方机构开展独立审查;由董事会下设独立委员会监督。

打开网易新闻 查看精彩图片

企业需要重点排查模型在网络安全、生物、化学领域的潜在风险,防止模型意外入侵各类技术系统。

签约企业还约定定期会商,共同研究行业标准。

特朗普称这份协议具备道德约束力,同时签署行政令,要求联邦机构在法律允许范围内,用 “超级智能” 替代 “人工智能” 表述。

打开网易新闻 查看精彩图片

这份看似声势浩大的协议缺少硬性约束。

打开网易新闻 查看精彩图片

协议没有划定 AI 能力上限,没有设置模型训练规模红线,也没有风险超标自动暂停研发的机制。

四层管控偏向安全工程层面,防范模型意外入侵系统,和 7 月联名信想要 “控制 AI 能力增长速度” 并不是同一目标。

简单来说,科研人员想要一套能给 AI 踩刹车的工具,白宫拿出的只是一份企业安全自查清单,二者的落差正是当下 AI 安全治理的核心矛盾。

打开网易新闻 查看精彩图片

想要理解白宫为何只推出一份自愿协议,可以先看清联名信暴露的行业困境。

声明本身就提到,没有企业愿意单方面减速。

OpenAI 停下,Anthropic 不会停;Anthropic 选择暂缓,谷歌依旧会继续研发。

打开网易新闻 查看精彩图片

各家企业都清楚,加速研发会放大整体安全风险,但任何一家率先减速,都会流失人才、客户,丢掉技术优势。

这就是典型的集体行动困境:从全行业安全角度,适度放缓是理性选择;但单独看每家企业,持续研发才是自保方案,而集体约束必须依靠强制力保障,白宫这份自愿协议恰恰缺少这一点。

把视野放大到全球,多国和国际组织都在推进 AI 治理讨论。2026 年 9 月 24 日,中美元首在白宫会谈,人工智能是重点议题。

打开网易新闻 查看精彩图片

根据中方发布的会谈成果,中美同意建立人工智能对话机制,下一轮对话定于 2026 年 11 月,同时搭建 AI 突发事件沟通渠道。

中国外交部发言人郭嘉昆在 9 月 28 日记者会上表示,中方坚持发挥联合国主渠道作用,构建公正合理的全球人工智能治理体系。

同年 7 月,上海世界人工智能大会召开,29 国代表签署协定,成立世界人工智能合作组织。

打开网易新闻 查看精彩图片

大会发布声明,呼吁头部 AI 企业审慎研发,为大模型增设安全防护。

德国等 20 国与欧盟也在 9 月 21 日发布联合声明,呼吁国际合作,确保人工智能始终由人类掌控。

各国虽都认可 AI 安全需要重视,但达成共识和落地执行之间仍存在巨大鸿沟。

打开网易新闻 查看精彩图片

白宫协议中提到的企业会商机制,也没有配套手段保证达成的规范能够落地。

2026 年 7 月的千人联名警示,和 9 月白宫签署的自愿承诺,共同揭示一个现实:AI 安全治理已经从讨论 “要不要管”,进入 “谁来管、怎么管” 的新阶段。

白宫这份自愿协议,代表美国现阶段选择依靠行业自我约束的治理路线。

打开网易新闻 查看精彩图片

中美建立 AI 对话渠道,是全球 AI 治理的积极尝试。

但从对话沟通,到核验安全承诺的技术手段,再到具备强制效力的执行规则,每一步都需要充足的政治意愿支撑。

而在 AI 行业激烈竞争的环境下,愿意主动限制自身技术发展的政治意愿,始终十分稀缺。

信源备注