9月8日,OpenAI宣布:一个内部模型,用约1万个AI智能体、88小时,解出了纳维-斯托克斯方程的存在性与光滑性问题——这是七大"千禧难题"之一,悬赏100万美元。这本该是AI数学的里程碑。但三天过去,风向变成了三个字:翻车了。先被指"题解错了",接着又卷入"抢跑"和署名争议。
一、OpenAI的版本:88小时,1万个智能体
先看OpenAI说了什么。它用约1万个并发智能体,跑了88小时,构造出了一个"有限时间爆破"的反例——一个初始完全正常的流体,在有限时间内速度趋向无穷大。这在物理上不可能发生,意味着方程在某种情况下会"失效"。
证明写了166页,还用Lean做了形式化验证,又花了17小时。整个过程中,智能体交换了约490万条消息、产生了3000亿token;其中Navier-Stokes部分就占了270万条消息、1300亿token。
成本呢?光是那1300亿token,按GPT-6 Astra的零售价算,就约650万美元;外部估算总成本在1000万到4000万美元之间。而OpenAI说,它不打算去申领那100万美元奖金——花几千万美元,解一道不领奖的题。
二、第一个反转:题,可能解错了
问题出在一个关键区别上:"有外力"和"无外力"。
克雷数学研究所的千禧难题,考的是"无外力"(unforced)的纳维-斯托克斯方程。而OpenAI证明的,是"有外力"(forced)的版本——你不断往流体里加外力,它当然更容易"炸掉"。
所以严格来说,这一题拿不到那100万美元;在数学界眼里,题目仍然悬而未决。克雷研究所所长Martin Bridson只说这是"exciting day"(激动人心的一天),没提颁奖。
背景补一句:七大千禧难题2000年公布,至今只有庞加莱猜想被证明——俄罗斯数学家佩雷尔曼做出来的,他还拒绝领奖。这道纳维-斯托克斯,北大韦东奕也深耕多年。
三、第二个反转:到底谁先做出来的
就在OpenAI宣布前几个小时,9月7日,纽约大学数学家Tristan Buckmaster和Anthropic研究员Levent Alpöge,先公开了相近的成果。
他们两个人,用Codex和Claude这两套AI工具,在流体力学这一方向上已经做了将近一年。菲尔兹奖得主陶哲轩(Terence Tao)评价他们的工作"remarkable"(了不起)。
Buckmaster的指控是:OpenAI听说了他们的进展——很可能是通过业内传言——然后用几乎一样的思路,抢跑把题"解"了出来。
"当我表示要把这些对话公开时,他反问我:你为什么要毁掉自己的职业生涯?" ——Tristan Buckmaster转述,OpenAI研究员Sébastien Bubeck的话(后者否认)
四、第三个反转:署名、数据,和那句"威胁"
争议进一步聚焦到三件事上。
第一件,署名。Buckmaster说,OpenAI的Sébastien Bubeck提议双方联合发布——但要把Alpöge排除在署名之外,原因只有一个:他在Anthropic工作。
第二件,数据。Buckmaster问,OpenAI的模型有没有见过他们的Codex会话(草稿就存在里面)。OpenAI说模型不会查用户数据,但"无法排除"去标识化的使用数据帮助了模型改进。
第三件,那句"威胁"。Buckmaster说,当他表示要把对话公开时,Bubeck反问"你为什么要毁掉自己的职业生涯"。
OpenAI的回应是:这些指控"categorically false"(断然不实),否认任何人或AI提前访问了Buckmaster和Alpöge的工作;Bubeck也否认要求排除Alpöge,称这一说法"虚假且煽动性"。
五、这件事,真正说明了什么
这已经不是"AI能不能做数学"的问题了,而是:AI时代的数学,游戏规则还没建立。
算力军备竞赛第一次真正烧进了数学:几千万美元、88小时,对阵两个数学家将近一年的工作。当AI能"算"出答案,三个灰色地带就全暴露了——署名(AI参与的工作,功劳归谁)、数据(训练数据里有没有别人的私有草稿)、验证(166页证明,至今没完全公开独立审)。
MIT Technology Review把这起事件称为数学史上的"潜在转折点"。这话不算夸张。
结语:题还没解,规则先乱了
那100万美元的题,其实还没被真正解开——至少"无外力"那个版本,没有。
但这场翻车暴露的东西,比"AI会不会做数学"更重要:当AI开始参与人类最顶级的智力竞赛,人类的贡献怎么算、边界在哪里,没有人有答案。
AI算出答案的速度,已经跑在了规则前面。
热门跟贴