10个Claude通宵15小时,证明122年物理数学难题

10个Claude通宵15小时,证明122年物理数学难题

AI 资讯 来源:新闻/公众号 发布时间:2026-09-30 更新于 2026-09-30 预计阅读 4 分钟

球面上的7个电子,难住了人类数百年。今天,10个Claude Sonnet 5.5通宵15小时,互发1270条消息,写出17895行Lean代码,完成了汤姆逊问题N=7的证明。没有人类介入,没有预设分工,10个Claude自己建群、讨论、选算法、合并代码。证明通过了Lean内核和独立内核nanoda的双重验证,改一个整数,nanoda立刻报错。

刚刚,十个Claude 5.5攻克百年物理猜想!

1904年,J.J.汤姆逊提出“葡萄干布丁”原子模型,想弄清电子在原子里的排布。模型后来被卢瑟福推翻,但留下的“汤姆逊问题”延续至今:把N个电子放在球面上,彼此排斥,怎样排布总能量最低?过去122年,被严格证明的只有2、3、4、6、12个点,靠几何对称性解决;5个点拖到2013年由Richard Schwartz借助计算机证完;8个点今年9月18日由Kryvonos、Liehr、Taylor挂上arXiv并用Lean形式化。7个点一直空着。

刚刚,十个Claude 5.5攻克百年物理猜想!

数十年来,超级计算机数值模拟结果都指向“五角双锥”构型:赤道均匀分布5个电子,南北两极各1个,理论能量约14.4529774142。但模拟不是证明,无法排除某处隐藏着能量更低的“幽灵构型”。

刚刚,十个Claude 5.5攻克百年物理猜想!

Vals AI的Hung Tran把任务交给10个Claude组成的虚拟实验室。人类只给定任务边界:两个固定Lean定理陈述和九个探索方向,智能体全部调到最大算力投入。15小时内,1270条技术讨论消息,有的试错贴出失败,有的改进,有的发现路径可合并。一个Claude主动认领“集成者”,把验证通过的零件塞进Solution.lean。硬规矩只有一条:没过检查器的不算,必须从零复现编译、与题面一字不差、不许偷加公理。

最终得到17895行Lean形式化证明。核心策略是按任意两个电子间最小内积m的值,把连续构型空间切成区域逐个击破。区域一m≥-0.90,用5次三点半定规划边界配合精确整数数据,证明能量高于五角双锥至少3×10⁻⁴。区域二m<-0.90,继续细分:[-0.99,-0.90]的五个切片各用严格三点凭证排除,高出最优能量约2.6×10⁻⁶;极冠区域m≤-0.99由高精度凭证约束,能量下界只比五角双锥低2.3×10⁻¹⁶,把潜在竞争者压缩到极窄邻域。随后用区间算术刚性论证和精确二阶局部极小值定理锁定唯一性。所有数值凭证全部舍入转换为精确整数与有理数,脱离浮点误差和外部求解器依赖。

验证结果:Lean内核全量编译599秒通过,lake build耗时344秒,完成8928个编译任务;独立内核nanoda校验47854个声明,零错误;负对照实验中,仅改动证明数据里的一个整数,nanoda立刻报错中止。

过去说AI做数学,指的是“会解题”。现在,一整条研究链条正在被Agent接管:找证明路线、并行试错、裁决哪条路值得走、把代码合进一个文件、交给机器验收。数学AI正从“会解题”走向“会做研究”。人类数学家花几十年没做到的事,10个AI只用了一个通宵,全程没有人类插手。它们不只证明了一个百年猜想,也证明了一件事:AI已经准备好,和人类一起做数学了。

标签: AI 资讯 AI

更多推荐阅读

Manus 2.0发布:AI应用只剩三件事

Manus 2.0发布:AI应用只剩三件事

昨夜,Manus发布2.0版本,堪称超级全家桶。技术层面推出新agent架构Cascade、云电脑和自动化;面向工作创作场景的Manus Studio支持剪视频、生视频、做在线多人游戏、远程遥控电脑;以及One More Thing:Cue。 我第一时间上手试了Cue。先连接Gmail、GitHub、Notion、Instagram、Oura等账号,补充Codex记忆备份和几条即刻,构成较完整的...

2026-09-30
GPT-6上线后,鹈鹕骑车测试为何突然爆火

GPT-6上线后,鹈鹕骑车测试为何突然爆火

开源项目CodexRadar发起人Lambda在GPT-6 Astra发布后,收到大量“鹈鹕骑单车”视频,于是在社区发起“鹈鹕杯”比赛,参赛者围绕“画一只骑自行车的鹈鹕”用模型生成作品。9月14日上午,比赛页面PV达7000多。 每次新模型上线,都有人用鹈鹕骑自行车测试模型能力。这个任务简单直观,能一眼看出腿和踏板是否对位、车轮是否跟着动、动作是否穿帮、前后是否一致;同时又足够复杂,涉及动作理解...

2026-09-30
Opus 5.5代码直出MV,马斯克连转惊呼AGI

Opus 5.5代码直出MV,马斯克连转惊呼AGI

Opus 5.5代码直出音乐MV火了。马斯克多次转发,并给出“嚯!”“史诗级!”“这次我真切感受到了AGI”等评价。 这些MV中,人物、歌词、拼贴、颗粒和转场贴着节拍轮番轰炸。两分钟速通《谷歌来时路》,动画越切越快,配乐越顶越燃。另一支纪念乔布斯的MV,从车库创业拍到改变个人计算,23种转场踩着120 BPM配乐,被剪成一部硅谷英雄片。还有博主把2011年录的木吉他老歌用Suno重编成Techn...

2026-09-30
反超Seedance 2.0!RunningHub增强版H3一秒仅一毛

反超Seedance 2.0!RunningHub增强版H3一秒仅一毛

7月底MiniMax H3开源时,Artificial Analysis视频编辑榜Elo 1130分,直冲全球第一。但量产场景下短板明显:多镜头一长角色走样,商品多拍几组轮廓不准,十几个镜头连跑后面越来越不像同一部片子。从“跑得通”到“生产能用”,差的是工程。 9月29日,RunningHub发布H3 RH Enhanced,基于MiniMax H3开源基座做深度后训练的增强模型。Running...

2026-09-30
AI写算子让Kimi K3推理快3倍,TPU反超英伟达

AI写算子让Kimi K3推理快3倍,TPU反超英伟达

上一周,vLLM原班人马创办的Inferact开源了TPU Megakernels,把Kimi K3的92个MoE层写进同一个程序,在16颗谷歌TPU v7上运行:开启投机解码,单用户输出达709 tokens/s;同样16块英伟达GB200用vLLM跑为452 tokens/s。关闭投机解码,在1到8并发下,它也是GB200的1.4到2倍。而TPU v7显存带宽7380GB/s,还低于GB200...

2026-09-30
GPT-6.1 Sol深夜突袭:1/5价格逼近Astra

GPT-6.1 Sol深夜突袭:1/5价格逼近Astra

在OpenAI开发者大会上,GPT-6.1 Sol突袭上线,并已接入Codex和ChatGPT Work。据称原定的GPT-6.1因对齐回归问题被紧急暂停,OpenAI转而推出这款“干活特化版”。官方口号是“以五分之一的价格,获得接近Astra的智能水平”。 价格方面,GPT-6.1 Sol的API标准价为输入2美元/百万Token、输出10美元/百万Token,恰好是GPT-6 Astra(输...

2026-09-30
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部