OpenAI一次公开722份数学手稿

OpenAI一次公开722份数学手稿

AI 资讯 来源:新闻/公众号 发布时间:2026-10-07 更新于 2026-10-07 预计阅读 4 分钟

10月7日,OpenAI在GitHub上线openai/math仓库,一次性发布722份手稿,归入372个问题家族,涵盖乘法函数、π的无理性指数、马勒猜想、黎曼zeta函数零点区域、海森堡铁磁体自发磁化、自由群因子同构等领域。仓库分三层:preprints目录放PDF和源文件,lean目录放Lean形式化证明,reasoning_traces目录放模型推理过程摘要,并公开10份推理摘要。OpenAI称绝大多数结果来自同一个未发布的内部模型,每道题平均消耗3小时ChatGPT Pro推理算力,总共提出约4000个问题。README中注明“部分未形式化的结果可能存在问题”。

刚刚,OpenAI公开722个数学发现!霍奇猜想、黎曼zeta函数等手稿挤爆GitHub

今年8月,OpenAI曾公开10道未解数学问题的解法,附Lean 4形式化证明和249页手稿。9月,OpenAI宣布内部模型解决Navier-Stokes千年难题及100多个跨领域长期未解问题,引发25位菲尔兹奖得主联名公开信,陶哲轩牵头批评OpenAI把数学当benchmark刷。OpenAI表示,722份手稿只是2026年AI产出数万个数学解法中“最新的一批”。

刚刚,OpenAI公开722个数学发现!霍奇猜想、黎曼zeta函数等手稿挤爆GitHub

数学家不满情绪升温。8月OpenAI召集约40位数学家开会,与会者称OpenAI暗示已解决数百个长期未解问题,并保证不会一次全部放出,建议走论文发表路径。OpenAI发言人Lindsay McCallum回应称公司“不知道”有过这样的保证。10月6日,WIRED报道称纽约大学访问数学教授Nestor Guillen形容AI公司行为像“黑帮”,西北大学数学家Bryna Kra称建议“显然被忽略了”。数学家在意的是成果何时算数、由谁说了算——过去需同行评审,如今722份手稿一次性发布,全由一家公司拍板。

刚刚,OpenAI公开722个数学发现!霍奇猜想、黎曼zeta函数等手稿挤爆GitHub

陶哲轩态度反转。几个月前他还呼吁同行拥抱AI,称数学正经历哥白尼革命。半年后他提出“Proof Indigestion”(证明消化不良):证明生命周期有五步——提出解答、机器验证、翻译成人话、同行消化、写进教科书,AI在前两步狂飙,后三步进展几乎为零。9月他联合25位菲尔兹奖得主发表公开声明,批评AI公司把数学当benchmark刷,并在演讲中表示:“必须慢下来。完全没理由这么快,一点理由都没有。”

9月28日,Hinton、Bengio、OpenAI首席科学家Jakub Pachocki、Anthropic联合创始人Jack Clark等20多人联合发表工作论文《如果自动化AI研发引发了智能爆炸怎么办?》。论文称,截至2026年8月,Anthropic内部AI系统在仅有高层监督下已独立完成26%的AI研发工作,五个月前该数字仅为1%。论文警告,一旦AI在AI研发上达到专家级能力,一个开发者就能指挥相当于“数百万”顶级人类研究者的AI团队,“一旦智能爆炸开始,行动的窗口可能就关闭了。”

数学标准绝对:证明对就是对,错就是错。过去人类确认知识的速度决定知识前进的速度,同行评审虽慢,却是科学信用体系的地基。如今这套体系头一次被机器产量甩在身后。AI做数学进入“量产”阶段,难处从“解不解得出来”变成“人类验不验得过来”。

标签: AI 资讯 AI

更多推荐阅读

AI几年内或超越所有人类?Anthropic研究员预测

AI几年内或超越所有人类?Anthropic研究员预测

Anthropic强化学习技术负责人Sholto Douglas在8月录制、10月2日上线的访谈中表示,能力等于甚至超过所有人类的模型,很可能在未来几年内出现。他设想AI能完成人类在电脑上做的所有工作,把原本需要几个世纪的科技进步压缩到一二十年。他推算,2028年AI年度资本开支可能达4万亿美元,全球GDP可能在2030年代初翻倍,届时地球上每个人都能享有连今天首富也无法拥有的富足。同场研究员Ni...

2026-10-07
陶哲轩为何突然转向AI减速派?

陶哲轩为何突然转向AI减速派?

曾最爱AI、逢人就安利AI工具的陶哲轩,一夜之间转向AI数学的对立面。在SAIR最新演讲中,他公开向模型公司开火:AI公司无休止加速,却对后果一无所知,必须慢下来,完全没理由这么快。感受到危机的远不止他一人,菲尔兹奖得主Cédric Villani在看到OpenAI拿下千禧难题后直言“大受震撼,简直跟世界末日一样”,而仅3个月前他还称LLM根本没有智能、只是统计学复读机。 就在几个月前,陶哲轩还...

2026-10-07
全球最大AI影视公司如何用模型拍电影

全球最大AI影视公司如何用模型拍电影

AI 视频已能生成足够像电影的镜头,但真正的 AI 电影仍很少。一旦进入长篇制作,角色一致性、镜头衔接、表演控制和团队协作都会成为问题。国内常见的 UGC 和 ProC 路线把编剧、导演、分镜、剪辑甚至制片压到一个创作者身上,AI 提升了个人效率,却没有把专业人群组织成生产线。ProC 的上限往往是模型的上限,影视公司的上限才可能是人的上限。 在 Artificial Analysis 最新有声...

2026-10-07
DeepSeek Harness兼容Claude Code Mods,作者回应

DeepSeek Harness兼容Claude Code Mods,作者回应

10月1日,Claude Code发布Mods,插件作者可用函数钩子改写提示词、拦截工具调用、在终端绘制界面。10月3日,DeepSeek Harness(DSH)发布v0.2.1-alpha.1,更新之一是实验性的Claude Code Mods兼容层。知乎随即出现相关讨论。10月4日下午,兼容层作者、DSH组崔添翼作答,明确“一切皆插件”与开源一样,是立项之初就定下的方向,不是被迫或模仿。 ...

2026-10-07
Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想

2026年8月30日,菲尔兹奖得主Hugo Duminil-Copin发文感叹,他倾注数年心血、屡败屡战的渗流猜想,恐怕迟早会被AI攻克。几乎同时,同行在GitHub上发现Anthropic工程师提交的代码仓库,其中是由大语言模型Claude生成、并经Lean严格验证的完整证明——困扰人类近70年的连续相变猜想已被AI证明。没有发布会,没有官方博客,消息传出后全球数学界震动。德国数学家Benedi...

2026-10-07
OpenAI启用文本水印,幕后推手是统计学诺奖得主

OpenAI启用文本水印,幕后推手是统计学诺奖得主

今天,OpenAI 宣布正式启用文本水印。即日起,全球 API 客户可为部分模型自行开启水印,默认仍关闭。未来几周,欧盟地区符合条件的 ChatGPT 与 Codex 文本输出将加上肉眼不可见的水印,覆盖所有付费档位。检测器仅向通过审核的研究者和专业机构开放申请,暂不面向公众。 直接推手是欧盟。《人工智能法》第 50 条自 2026 年 8 月 2 日起适用,要求生成式 AI 提供方以机器可读方...

2026-10-07
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部