新智元报道
100 个电子的量子行为,用暴力方法计算一次所需的时间超过宇宙的年龄。
一颗药物分子动辄上千个电子,一块电池材料更多。模拟它们,是药物、电池、芯片研发的底层需求。
加州理工学院 Anima Anandkumar 团队 8 月 24 日发了一篇论文,用一个 AI 模型把这类计算的复杂度从立方级压到了近线性级。
https://x.com/AnimaAnandkumar/status/2092031815448248594
效果相当震撼:在单块 GPU 上完成了一个含 82500 个电子的金属缺陷模拟,2019 年同类计算用了约 7800 块 GPU。
困了 60 年的瓶颈
量子化学领域最常用的计算方法叫密度泛函理论(DFT),诺贝尔奖级的理论,药物筛选、催化剂设计、电池材料研发都离不开它。
问题在于太慢:体系每大一点,计算量就呈立方增长——电子数翻 10 倍,计算量涨 1000 倍。
60 年来,物理学家一直在找让它提速的办法,但没有实质突破。
AI 尝试过两种思路。
一种思路是让模型直接预测最终结果,一步到位。
训练分布内效果不错,但外推能力很差:分子一旦大于训练集中见过的,误差就失控。
论文实测,从小分子外推到药物级分子时,直接预测模型的误差从不到 1% 飙到约 10%,最高达 41%。
另一种思路沿用物理学家的老路,让 AI 学一个逆向映射。
这条路数学上不稳定,论文的对照实验中,所有计算都在迭代几步后发散,全军覆没。
像思维链一样迭代
而不是一步猜答案
这篇论文换了一个方向。
DFT 的计算流程是一个反复迭代的过程:每轮给定一组输入条件,算出电子密度,再用密度更新输入条件,循环往复直到结果稳定。
传统方法卡在每轮迭代中都要做一次计算量巨大的求解,这一步是立方级的。
Anandkumar 团队的做法是:用 AI 替掉这一步。
训练一个傅里叶神经算子(FNO),让它学会「给定输入条件,输出对应的电子密度」这个正向映射,计算复杂度从 O(N³) 降到 O(N log N)。
然后把模型嵌回原来的迭代循环,其他步骤照旧。
https://x.com/AnimaAnandkumar/status/2090125110309204371
可以这样理解:直接预测模型相当于让 LLM 对一道难题一步给出最终答案,简单题没问题,难题容易错。
Kohn-Sham FNO 相当于让模型做推理时的思维链,分步推演,每一步都能自我校验,错了后续迭代会把它拉回来。
这种设计还自带一个直接预测模型没有的优势:安全阀。
如果模型被推到了能力范围之外,迭代会发散,研究者立刻知道结果不可信。
论文中镁位错实验的第一次尝试就验证了这一点:用通用预训练模型直接算,所有计算立即发散——发散本身就是警报。
直接预测模型给出一个答案,你无从判断它是对是错。
训练数据只用了 8504 个结构,一个模型同时处理分子和固体材料,覆盖元素周期表前五行。
这得益于团队设计的一种域不变 FNO 变体:不同大小的体系共享同一套学到的滤波器,小分子和大块晶体用同一个模型。
外推到训练集没见过的药物级大分子时,Kohn-Sham FNO 的密度误差为 2.23%,直接预测模型为 9.97%。
分子越大差距越明显:到 45 个重原子时,直接预测误差飙到 41%,Kohn-Sham FNO 只有 4%。
1 块 GPU,8 万个电子
团队拿镁的位错结构做了大规模验证。
2019 年,一项获得 ACM 戈登贝尔奖提名的研究对 6164 个镁原子做了全量 DFT 计算,动用了 Summit 超算上约 7800 块 NVIDIA V100 GPU。
而最新的 Kohn-Sham FNO 在单块 NVIDIA B300 GPU 上完成了 8250 个原子、82500 个价电子的计算,全部收敛。
实测缩放指数为 1.03(接近完美线性),传统方法为 3.37(立方级)。
1 块 B300 与 7800 块 V100 不是硬件对等比较,但缩放指数不受硬件影响:一个近线性,一个立方,体系越大差距越不可逆。
论文发布同一天,Anandkumar 宣布创办 AI 物理模拟公司 Accelerated Understanding,路透社随后做了报道。
https://www.reuters.com/business/ai-founders-who-walked-away-bezos-backed-prometheus-model-universe-2026-08-25/
据她在 X 上介绍,公司训练的 AI 模型在 4D 空间中模拟物理现象,推理上下文长度超过 5 万亿。
https://x.com/AnimaAnandkumar/status/2092236528898675014
目前 Kohn-Sham FNO 只学了计算流程中的一个环节,完整的能量计算还需要一步后处理。
但路径已经清楚:AI 替代的不是物理,是物理计算中最烧钱的那一步重复运算。
团队下一步计划补上剩余环节,届时后处理也可以省掉。未来可期。
团队创始人合照
参考资料:
https://tensorlab.cms.caltech.edu/users/anima/ks_fno.html
编辑:马可
热门跟贴