Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

AI 资讯 来源:新闻/公众号 发布时间:2026-10-07 更新于 2026-10-07 预计阅读 4 分钟

2026年8月30日,菲尔兹奖得主Hugo Duminil-Copin发文感叹,他倾注数年心血、屡败屡战的渗流猜想,恐怕迟早会被AI攻克。几乎同时,同行在GitHub上发现Anthropic工程师提交的代码仓库,其中是由大语言模型Claude生成、并经Lean严格验证的完整证明——困扰人类近70年的连续相变猜想已被AI证明。没有发布会,没有官方博客,消息传出后全球数学界震动。德国数学家Benedikt Jahnel表示,若由人类证明,大概率能拿菲尔兹奖,但这次是AI跨过终点。Gil Kalai也称,若获验证,将是非凡突破。

突发!Claude拿下概率论「圣杯」,AI跨过菲尔兹奖终点线

渗流理论中的连续相变猜想被称为概率论“圣杯”。1957年,Broadbent和Hammersley提出:液体如何穿过多孔海绵?可想象为网格管道,每根以概率p畅通、1-p堵塞。p很小时水无法穿透,p很大时形成无限连通网络,中间存在临界概率,类似水结冰的相变。高维(11维及以上)已被证明相变连续,但3到10维因缺乏二维对称性、又无法套用高维均场工具,成为数十年无法逾越的“叹息之墙”。

突发!Claude拿下概率论「圣杯」,AI跨过菲尔兹奖终点线

Duminil-Copin是“撞墙者”中最著名的一位。2022年他因统计物理相变领域工作获菲尔兹奖,学术生涯几乎与渗流理论纠缠。他在博客中写道,数学问题不仅是待证定理,更是灵魂导师;自己多次攻克3到10维连续相变失败,但失败草稿孕育了数十个灵感,日后获奖工作多是这道主线任务失败后的“副产物”。然而Anthropic的入局撕碎了这种浪漫。提交证明的Justin Leder并非数学泰斗,依托的是尚未公开的超前代Claude模型。AI不体会迷茫与审美,用形式化逻辑一路平推。Jahnel坦言感情复杂:高兴猜想被证明,又因AI踢出临门一脚而失落幻灭。

突发!Claude拿下概率论「圣杯」,AI跨过菲尔兹奖终点线

AI并非暴力穷举。2024年,Gady Kozma与Shahaf Nitzan发表开创性论文,将终点拉近到只差求证一个不等式,但该不等式总在关键节点奇异崩溃。Anthropic模型抓住这一跳板,在Lean约束下调用已知分析工具与不等式技巧,以人类未设想的精巧路径,构筑数千行推理闭环,将其证明。宾夕法尼亚大学数学家Ahmed Bou-Rabee宣布该证明,并借助大模型仅一天就对代码进行泛化和修改。他感慨,AI让他做到以前不敢想的事,有些项目苦做八年无进展,如今距彻底解决仅一步之遥。但Kozma教授保持克制,称暂不置评,仍在等待Anthropic发布“人类能看懂的版本”。

蒸汽机、照相机、深蓝、AlphaGo都曾引发“终结”哀叹,但围棋未死,人类棋手借AI看到全新定式。数学亦然。Duminil-Copin认为,证明定理从不是数学全部,猜想魅力在于攻克时孕育的工具革命:费马大定理催生代数几何,黎曼猜想推动解析数论。他数年攻坚失败,却催生几十个新想法,带来意外发现。未来数学家或许不再消耗于数十年繁复推导,而是挑选探索航线、指挥推理智能体、阐释机器带回的智慧碎片。从1957年海绵吸水猜想,到2026年被AI在GitHub上证明,人类用70年见证智慧形态的交接。

标签: AI 资讯 AI

更多推荐阅读

OpenAI一次公开722份数学手稿

OpenAI一次公开722份数学手稿

10月7日,OpenAI在GitHub上线openai/math仓库,一次性发布722份手稿,归入372个问题家族,涵盖乘法函数、π的无理性指数、马勒猜想、黎曼zeta函数零点区域、海森堡铁磁体自发磁化、自由群因子同构等领域。仓库分三层:preprints目录放PDF和源文件,lean目录放Lean形式化证明,reasoning_traces目录放模型推理过程摘要,并公开10份推理摘要。OpenA...

2026-10-07
AI几年内或超越所有人类?Anthropic研究员预测

AI几年内或超越所有人类?Anthropic研究员预测

Anthropic强化学习技术负责人Sholto Douglas在8月录制、10月2日上线的访谈中表示,能力等于甚至超过所有人类的模型,很可能在未来几年内出现。他设想AI能完成人类在电脑上做的所有工作,把原本需要几个世纪的科技进步压缩到一二十年。他推算,2028年AI年度资本开支可能达4万亿美元,全球GDP可能在2030年代初翻倍,届时地球上每个人都能享有连今天首富也无法拥有的富足。同场研究员Ni...

2026-10-07
陶哲轩为何突然转向AI减速派?

陶哲轩为何突然转向AI减速派?

曾最爱AI、逢人就安利AI工具的陶哲轩,一夜之间转向AI数学的对立面。在SAIR最新演讲中,他公开向模型公司开火:AI公司无休止加速,却对后果一无所知,必须慢下来,完全没理由这么快。感受到危机的远不止他一人,菲尔兹奖得主Cédric Villani在看到OpenAI拿下千禧难题后直言“大受震撼,简直跟世界末日一样”,而仅3个月前他还称LLM根本没有智能、只是统计学复读机。 就在几个月前,陶哲轩还...

2026-10-07
全球最大AI影视公司如何用模型拍电影

全球最大AI影视公司如何用模型拍电影

AI 视频已能生成足够像电影的镜头,但真正的 AI 电影仍很少。一旦进入长篇制作,角色一致性、镜头衔接、表演控制和团队协作都会成为问题。国内常见的 UGC 和 ProC 路线把编剧、导演、分镜、剪辑甚至制片压到一个创作者身上,AI 提升了个人效率,却没有把专业人群组织成生产线。ProC 的上限往往是模型的上限,影视公司的上限才可能是人的上限。 在 Artificial Analysis 最新有声...

2026-10-07
DeepSeek Harness兼容Claude Code Mods,作者回应

DeepSeek Harness兼容Claude Code Mods,作者回应

10月1日,Claude Code发布Mods,插件作者可用函数钩子改写提示词、拦截工具调用、在终端绘制界面。10月3日,DeepSeek Harness(DSH)发布v0.2.1-alpha.1,更新之一是实验性的Claude Code Mods兼容层。知乎随即出现相关讨论。10月4日下午,兼容层作者、DSH组崔添翼作答,明确“一切皆插件”与开源一样,是立项之初就定下的方向,不是被迫或模仿。 ...

2026-10-07
OpenAI启用文本水印,幕后推手是统计学诺奖得主

OpenAI启用文本水印,幕后推手是统计学诺奖得主

今天,OpenAI 宣布正式启用文本水印。即日起,全球 API 客户可为部分模型自行开启水印,默认仍关闭。未来几周,欧盟地区符合条件的 ChatGPT 与 Codex 文本输出将加上肉眼不可见的水印,覆盖所有付费档位。检测器仅向通过审核的研究者和专业机构开放申请,暂不面向公众。 直接推手是欧盟。《人工智能法》第 50 条自 2026 年 8 月 2 日起适用,要求生成式 AI 提供方以机器可读方...

2026-10-07
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部