加州理工用AI攻克量子化学60年难题,1块显卡做完7800块的活!

100 个电子的量子行为,用暴力方法计算一次所需的时间超过宇宙的年龄。
一颗药物分子动辄上千个电子,一块电池材料更多。模拟它们,是药物、电池、芯片研发的底层需求。
加州理工学院 Anima Anandkumar 团队 8 月 24 日发了一篇论文,用一个 AI 模型把这类计算的复杂度从立方级压到了近线性级。
https://x.com/AnimaAnandkumar/status/2092031815448248594
效果相当震撼:在单块 GPU 上完成了一个含 82500 个电子的金属缺陷模拟,2019 年同类计算用了约 7800 块 GPU。
困了 60 年的瓶颈
量子化学领域最常用的计算方法叫密度泛函理论(DFT),诺贝尔奖级的理论,药物筛选、催化剂设计、电池材料研发都离不开它。
问题在于太慢:体系每大一点,计算量就呈立方增长——电子数翻 10 倍,计算量涨 1000 倍。
60 年来,物理学家一直在找让它提速的办法,但没有实质突破。
AI 尝试过两种思路。
一种思路是让模型直接预测最终结果,一步到位。
训练分布内效果不错,但外推能力很差:分子一旦大于训练集中见过的,误差就失控。
论文实测,从小分子外推到药物级分子时,直接预测模型的误差从不到 1% 飙到约 10%,最高达 41%。
另一种思路沿用物理学家的老路,让 AI 学一个逆向映射。
这条路数学上不稳定,论文的对照实验中,所有计算都在迭代几步后发散,全军覆没。
像思维链一样迭代而不是一步猜答案
这篇论文换了一个方向。
DFT 的计算流程是一个反复迭代的过程:每轮给定一组输入条件,算出电子密度,再用密度更新输入条件,循环往复直到结果稳定。
传统方法卡在每轮迭代中都要做一次计算量巨大的求解,这一步是立方级的。
Anandkumar 团队的做法是:用 AI 替掉这一步。
训练一个傅里叶神经算子(FNO),让它学会「给定输入条件,输出对应的电子密度」这个正向映射,计算复杂度从 O(N³) 降到 O(N log N)。
然后把模型嵌回原来的迭代循环,其他步骤照旧。
https://x.com/AnimaAnandkumar/status/2090125110309204371
可以这样理解:直接预测模型相当于让 LLM 对一道难题一步给出最终答案,简单题没问题,难题容易错。
Kohn-Sham FNO 相当于让模型做推理时的思维链,分步推演,每一步都能自我校验,错了后续迭代会把它拉回来。
这种设计还自带一个直接预测模型没有的优势:安全阀。
如果模型被推到了能力范围之外,迭代会发散,研究者立刻知道结果不可信。
论文中镁位错实验的第一次尝试就验证了这一点:用通用预训练模型直接算,所有计算立即发散——发散本身就是警报。
直接预测模型给出一个答案,你无从判断它是对是错。
训练数据只用了 8504 个结构,一个模型同时处理分子和固体材料,覆盖元素周期表前五行。
这得益于团队设计的一种域不变 FNO 变体:不同大小的体系共享同一套学到的滤波器,小分子和大块晶体用同一个模型。
外推到训练集没见过的药物级大分子时,Kohn-Sham FNO 的密度误差为 2.23%,直接预测模型为 9.97%。
分子越大差距越明显:到 45 个重原子时,直接预测误差飙到 41%,Kohn-Sham FNO 只有 4%。
1 块 GPU,8 万个电子
团队拿镁的位错结构做了大规模验证。
2019 年,一项获得 ACM 戈登贝尔奖提名的研究对 6164 个镁原子做了全量 DFT 计算,动用了 Summit 超算上约 7800 块 NVIDIA V100 GPU。
而最新的 Kohn-Sham FNO 在单块 NVIDIA B300 GPU 上完成了 8250 个原子、82500 个价电子的计算,全部收敛。
实测缩放指数为 1.03(接近完美线性),传统方法为 3.37(立方级)。
1 块 B300 与 7800 块 V100 不是硬件对等比较,但缩放指数不受硬件影响:一个近线性,一个立方,体系越大差距越不可逆。
论文发布同一天,Anandkumar 宣布创办 AI 物理模拟公司 Accelerated Understanding,路透社随后做了报道。
https://www.reuters.com/business/ai-founders-who-walked-away-bezos-backed-prometheus-model-universe-2026-08-25/
据她在 X 上介绍,公司训练的 AI 模型在 4D 空间中模拟物理现象,推理上下文长度超过 5 万亿。
https://x.com/AnimaAnandkumar/status/2092236528898675014
目前 Kohn-Sham FNO 只学了计算流程中的一个环节,完整的能量计算还需要一步后处理。
但路径已经清楚:AI 替代的不是物理,是物理计算中最烧钱的那一步重复运算。
团队下一步计划补上剩余环节,届时后处理也可以省掉。未来可期。
团队创始人合照
https://tensorlab.cms.caltech.edu/users/anima/ks_fno.html
文章来自于微信公众号 “新智元”,作者 “新智元”
更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速
理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。
2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启
2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。
2026-09-05
AI报告读着累?新指标用隐喻率量化可读性
Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。
2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%
Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。
2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿
Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。
2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明
Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。
2026-09-05