OpenAI一次放出722篇数学成果,准黎曼猜想在列

OpenAI一次放出722篇数学成果,准黎曼猜想在列

AI 资讯 来源:新闻/公众号 发布时间:2026-10-07 更新于 2026-10-07 预计阅读 5 分钟

今天早上,AI 圈与数学圈被一份 GitHub 仓库震撼:722 篇数学手稿,归入 372 个成果族,全部由一个尚未发布的内部前沿模型产出。清单包括准黎曼猜想、四维挂谷猜想、唯一游戏猜想、自由群因子同构问题、有理数域上的希尔伯特第十问题、CM 阿贝尔簇的霍奇猜想、马勒猜想等重量级问题。Sam Altman 称我们正进入大发现的新时代。

突发!OpenAI一次放出722篇数学成果,准黎曼猜想、4D挂谷都在列

OpenAI 表示,这批成果来自对内部模型的数学能力评估。因既有评测已饱和,团队转向开放研究问题,投喂约 4000 个问题,按相关性和重要性筛选后留下 372 族、722 篇手稿。成果族通常包含主结果及配套论证。按学科标注覆盖 17 个方向,最多的是理论计算机科学(40 族)、组合数学(37 族)、代数与复几何(36 族)和数论(31 族),数理逻辑最少也有 6 族。算力上,平均每个结果约消耗相当于 3 小时 ChatGPT Pro 思考的算力。手稿文件夹日期几乎全部集中在 9 月 23 日至 10 月 5 日,其中 9 月 23 日和 24 日各近 200 篇。

突发!OpenAI一次放出722篇数学成果,准黎曼猜想、4D挂谷都在列

仓库还放出三类证明工件:Lean 形式化证明、10 份推理摘要、计算量与尝试问题数统计。372 族中 235 族附带 Lean 形式化说明页,约占六成三。OpenAI 承认未形式化结果可能存在问题,会尽快修正补充。仓库三小时 Star 破 2k。

突发!OpenAI一次放出722篇数学成果,准黎曼猜想、4D挂谷都在列

最受关注的是编号 003 准黎曼猜想:OpenAI 给出 θ=7/8,对 zeta 函数和所有狄利克雷 L 函数一致成立,并已 Lean 形式化,还给出 Landau–Siegel 零点的一致排除结果。编号 074 同时声称解决三维挂谷极大函数猜想和四维豪斯多夫维数猜想。此外,编号 102 声称证明唯一游戏猜想并给出 Max-Cut、顶点覆盖等最优近似难度门槛;编号 032 声称对所有复 CM 阿贝尔簇证明有理霍奇猜想;编号 002 与 006 给出每条有理椭圆曲线一个密度为一的二次扭曲族上完整的 BSD 公式;编号 004 对有理数域上的希尔伯特第十问题给出否定解答;编号 287 声称解决自由群因子同构问题,结论是不同秩的自由群因子彼此同构。清单还包括 π 的无理性测度恰为 2、卡塔兰常数为无理数、马勒猜想所有维数成立、平面不能用五种颜色完成单位距离染色等,以及对 Kaplansky 零因子猜想、Hadwiger 猜想的反例构造。

模型本身始终缺席。OpenAI 未公布名字,只称“内部前沿模型”,并表示正推进“负责任的发布”。9 月 8 日,OpenAI 曾发布 Navier-Stokes 公告,称一个显著强于 GPT-6 Astra 的内部模型用约 1 万个并行智能体、88 小时证明三维不可压缩流体可产生有限时间奇点,并用 GPT-6 Astra 花 17 小时完成 Lean 形式化。发布前夕,OpenAI 发言人证实该模型已解决“数学大多数领域里”超过 100 个长期未决问题。

过去两个多月,AI 实验室与数学家摩擦不断。8 月 1 日,OpenAI 公布 Astra 十项进展,几天后数学家指出其中证伪 Connes 刚性猜想的反例有误。8 月 11 日,Anthropic 也披露未发布模型在黎曼猜想相关方向取得进展。据《连线》报道,OpenAI 8 月私下召集约 40 位数学家讨论 AI 超越人类后的应对,暗示已解决数以百计长期难题,并就是否一次性放出征求意见。西北大学数学家回忆,与会者情绪兴奋与恐惧交织,要求写成论文而非博客推文。纽约大学 Tristan Buckmaster 指控 OpenAI 抢跑其与 Levent Alpöge 的私下合作。

9 月 11 日,包括陶哲轩在内的 25 位菲尔兹奖得主联署声明,认为仓促公告留不出时间写好论文、做好引用,会带来署名与抄袭问题。此前,4000 多名数学家联署的《莱顿宣言》已要求 AI 公司遵守数学界标准。9 月 29 日,高等研究院数学与人工智能独立咨询小组发布 AI 生成数学成果的发布建议,分“初次发布”和“支持理解”两步,要求引用已有工作、公开模型与提示词、尽量形式化、存放中立仓库、报告失败率,并资助会议和提供广泛模型访问。OpenAI 此次援引了该文件,其答卷被认为“有选择地及格”:公开推理摘要、算力估计和尝试问题数,承诺资助研讨会,承诺版本留痕,形式化超六成。

标签: AI 资讯 AI

更多推荐阅读

OpenAI一次公开722份数学手稿

OpenAI一次公开722份数学手稿

10月7日,OpenAI在GitHub上线openai/math仓库,一次性发布722份手稿,归入372个问题家族,涵盖乘法函数、π的无理性指数、马勒猜想、黎曼zeta函数零点区域、海森堡铁磁体自发磁化、自由群因子同构等领域。仓库分三层:preprints目录放PDF和源文件,lean目录放Lean形式化证明,reasoning_traces目录放模型推理过程摘要,并公开10份推理摘要。OpenA...

2026-10-07
AI几年内或超越所有人类?Anthropic研究员预测

AI几年内或超越所有人类?Anthropic研究员预测

Anthropic强化学习技术负责人Sholto Douglas在8月录制、10月2日上线的访谈中表示,能力等于甚至超过所有人类的模型,很可能在未来几年内出现。他设想AI能完成人类在电脑上做的所有工作,把原本需要几个世纪的科技进步压缩到一二十年。他推算,2028年AI年度资本开支可能达4万亿美元,全球GDP可能在2030年代初翻倍,届时地球上每个人都能享有连今天首富也无法拥有的富足。同场研究员Ni...

2026-10-07
陶哲轩为何突然转向AI减速派?

陶哲轩为何突然转向AI减速派?

曾最爱AI、逢人就安利AI工具的陶哲轩,一夜之间转向AI数学的对立面。在SAIR最新演讲中,他公开向模型公司开火:AI公司无休止加速,却对后果一无所知,必须慢下来,完全没理由这么快。感受到危机的远不止他一人,菲尔兹奖得主Cédric Villani在看到OpenAI拿下千禧难题后直言“大受震撼,简直跟世界末日一样”,而仅3个月前他还称LLM根本没有智能、只是统计学复读机。 就在几个月前,陶哲轩还...

2026-10-07
全球最大AI影视公司如何用模型拍电影

全球最大AI影视公司如何用模型拍电影

AI 视频已能生成足够像电影的镜头,但真正的 AI 电影仍很少。一旦进入长篇制作,角色一致性、镜头衔接、表演控制和团队协作都会成为问题。国内常见的 UGC 和 ProC 路线把编剧、导演、分镜、剪辑甚至制片压到一个创作者身上,AI 提升了个人效率,却没有把专业人群组织成生产线。ProC 的上限往往是模型的上限,影视公司的上限才可能是人的上限。 在 Artificial Analysis 最新有声...

2026-10-07
DeepSeek Harness兼容Claude Code Mods,作者回应

DeepSeek Harness兼容Claude Code Mods,作者回应

10月1日,Claude Code发布Mods,插件作者可用函数钩子改写提示词、拦截工具调用、在终端绘制界面。10月3日,DeepSeek Harness(DSH)发布v0.2.1-alpha.1,更新之一是实验性的Claude Code Mods兼容层。知乎随即出现相关讨论。10月4日下午,兼容层作者、DSH组崔添翼作答,明确“一切皆插件”与开源一样,是立项之初就定下的方向,不是被迫或模仿。 ...

2026-10-07
Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

2026年8月30日,菲尔兹奖得主Hugo Duminil-Copin发文感叹,他倾注数年心血、屡败屡战的渗流猜想,恐怕迟早会被AI攻克。几乎同时,同行在GitHub上发现Anthropic工程师提交的代码仓库,其中是由大语言模型Claude生成、并经Lean严格验证的完整证明——困扰人类近70年的连续相变猜想已被AI证明。没有发布会,没有官方博客,消息传出后全球数学界震动。德国数学家Benedi...

2026-10-07
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部