OpenAI新模型24天攻克100+数学难题
数学界正被AI迅速逼近。OpenAI一篇重磅博文披露,一款8月28日才开始训练的内部新模型,已攻克100多道世界级数学难题,横跨数学大部分领域,其中包括困扰学界多年的“纳维–斯托克斯”千禧年难题。从开训到9月21日官宣仅24天,进化速度令OpenAI内部数学家都感到意外。

9月8日,OpenAI称该内部模型在88小时内攻克NS千禧年难题,给出NS方程存在性与光滑性问题的证明,并公开166页论文和Lean形式化验证代码。该结果表明:在光滑外力作用下,初始静止、光滑的三维不可压缩流体,可在有限时间内形成奇点,对应千禧年大奖难题官方表述中的C、D版本。证明背后是一次大规模、1万多个并发Agent协同研究,它们可读取互联网缓存、运行代码、组内交换信息,不同小组探索不同版本与路线。研究人员持续参与,在系统先取得欧拉方程相关成果后,把资源向纳维–斯托克斯问题集中,再通过Codex汇总各组有价值的中间见解。9月5日,距首批智能体启动约88小时,系统得出解法;随后GPT‑6 Astra又花17小时完成Lean形式化与验证。

OpenAI表示,成果范围已进一步扩大,除纳维–斯托克斯外,还有百余道长期开放难题。这种进展已引发内部讨论:怎样让数学共同体及时了解变化,为准备和适应留出空间。“怎样审查、怎样发布”也成为现实问题。

就在OpenAI宣布NS方程突破三天后,27位菲尔兹奖得主联名发表公开信《AI在数学领域的严重错位》,签名者横跨48年菲尔兹奖历史,包括邓煜、陶哲轩、许埈珥、吴宝珠、彼得·舒尔茨、马丁·海雷尔等。公开信承认AI有加速真正数学研究的巨大潜力,但批评各大AI巨头把人类几百年沉淀的公开数学难题当成跑分刷榜的benchmark;解题指标可能与数学研究追求的理解发生偏离,且仓促公布后没有时间梳理思路和充分撰写新方法。OpenAI未回避,在最新公告中直接引用该文,表示AI巨头和数学家之间必须坐下来好好聊聊。
因此,OpenAI请来9位全球顶尖数学家,成立独立数学顾问组。成员来自剑桥、牛津、哈佛、斯坦福、伯克利、普林斯顿高等研究院等机构,包括菲尔兹奖得主Timothy Gowers、Martin Hairer,以及Edward Witten等。任务主要有三件:判断新数学成果的重要性;讨论结果该如何发布、何时发布;确保AI时代数学研究仍遵守学术和职业规范。这9人不拿OpenAI一分钱,可公开批评OpenAI,可提出公司未要求的建议,可自行决定成员变更。但关键限制是,顾问组不负责建议OpenAI如何控制内部数学研究的进度——有公开发言权,没有“刹车权”。
一切已极其明朗。开训不到一个月,刷爆100多道历史难题。技术瓶颈早已不在“AI解不解得出”,而变成“人类审不审得完”。全世界能审纳维–斯托克斯级别证明的人,两只手数得过来。这支“九人顾问天团”的真实功能,更像是OpenAI给机器产物找的顶级流水线兼排雷组:哪道题值得先看、哪道要拆开重写、找谁核对、署谁的名字,全丢给9位不拿工资的大神,而疯狂刷题的引擎油门仍攥在公司手里。
数学界已意识到这场海啸。多伦多大学数论学家Daniel Litt透露,与各系系主任聊完的共识是:激励机制、招聘规范和博士评价方式必须彻底重构,大家已准备好保卫数学文化,不再鼓励“单纯生产PDF”。菲尔兹奖得主Figalli预言,数学家的角色正从“解题的人”被迫变成“判断哪些题值得解的人”。OpenAI已毫不掩饰地确立新世界潜规则:发现归机器,验收和解释归人类。物理、化学、生物迟早也会走到这一步,每一门学科都会有这么一天。数学,只是先到了而已。
更多推荐阅读

平头哥真武V900发布:AI算力从单卡走向千卡互联
从真武 V900 到新一代磐久超节点服务器,平头哥八年来布局的 AI 芯片、CPU、scale up 互联、scale out 网络和存储芯片,开始被装进同一套算力系统。9 月 22 日 2026 杭州云栖大会上,平头哥被完整推到主论坛台前,副总裁高慧发表题为「Agentic 时代卓越算力基石」的演讲,发布从真武 V900 芯片到 ICN Switch 互联芯片、磐脉智能网卡、镇岳 SSD 主控、...
2026-09-23
陆川用AI五天复原明代大爆炸,阿里全模态模型兜底影视生产
不用搭景,不用等演员,导演陆川和团队用AI把一场400年前的明代灾难现场做了出来。宫廷、火药库,以及史料中烟云如黑灵芝的大爆炸,按传统影视工业做法往往需要数月时间和千万级投入,这次只用了5天。 人物的脸、皮肤、神态已相当逼真,爆炸的烟尘、碎片、火光也稳稳接住。过去光是一场爆炸戏就要耗费19天。陆川团队把史料文字翻译成现代视觉概念,前后做了约四轮提示词优化,再参考真实爆炸影像校准。阿里视频生成模型...
2026-09-23
国产AI生图新高度:真假难辨,还能精修到商用
两张图都是AI生成的,来自商汤科技正式上线的SenseNova U1 Pro,目前可在商汤小浣熊平台使用,API已向企业客户开放。 实测在SenseNova Studio平台进行,模型支持2K起步、最高4K清晰度。第一轮测试将一张生活照重构为纸质风格,随后仅修改人物外套内的黑色圆领T恤为白色,要求严格限定在可见内搭区域。由于T恤、皮带、裤子均为黑色且有胸牌遮挡,边界易混淆,但U1 Pro精准拿捏...
2026-09-23
剪映发布全新AI创作能力:从专业剪辑到普通用户全面提效
剪映在2026 AI新创作发布会上发布全新AI能力,覆盖PC专业版与App端,分别聚焦“提效”与“省心”。 PC专业版推出剪映Hub,一站式AI创作平台,将AI创作与多轨道剪辑连接,让脚本、素材与创作上下文在同一项目中延续,减少跨工具切换的断点与重复操作。剪映助手Agent介入专业创作流程,承担素材整理、粗剪、包装等工作,可根据创作目标规划任务、串联模型工具并自动运行,用户也可自定义工作流,沉淀...
2026-09-23
AI操控游戏新选择:Jev模型到底能做什么?
Jev 是 TypeSafe AI 推出的决策模型,创始人 Diogo Almeida 曾在 OpenAI 参与指令跟随与对话研究。TypeSafe 开发两年后发布该系统,官方称为 System One Models。其使用方式是把当前情况和问题输入,模型返回程序可直接使用的结果,本质上是分类模型,接口主要有三种类型。 在游戏场景中,可每一步询问它:当前血量、怪物和金币位置、出口位置,目标是拿金...
2026-09-23
阿里云栖大会:吴泳铭为何用经济学讲AI未来
9月22日,杭州云栖大会,阿里巴巴集团CEO吴泳铭发表开场主旨演讲。过去几年,云栖大会演讲常被视为技术风向标,但这次吴泳铭花了很多时间讲工业革命、电和经济学,重心不在AI会变成什么样,而在AI会让世界变成什么样。他提出核心观点:上一次类似变化是工业革命把动力变成规模化商品,人类发明蒸汽机、内燃机和电,并围绕它们建立现代产业,这一次轮到思考。当一个CEO用经济学语言描述未来,说明他思考的已不仅是产品...
2026-09-23