OpenAI高管回应陶哲轩:AI不止解题,未来或成数学研究伙伴

OpenAI高管回应陶哲轩:AI不止解题,未来或成数学研究伙伴

AI 资讯 来源:新闻/公众号 发布时间:2026-09-15 更新于 2026-09-15 预计阅读 5 分钟

说AI毁了数学,可能还是太小瞧AI了。OpenAI训练负责人Liam Fedus回应了陶哲轩等数学家关于“AI不应只追求解题,更应推动数学理解”的观点。他赞同对概念理解的重视,但认为不能用今天AI的能力边界框定未来可能性。在他看来,未来AI不仅能解决问题,还能提出洞见、建立新概念框架,成为既能给答案也能创造新思路的数学研究伙伴。

这份乐观与陶哲轩等25位菲尔兹奖得主联署的声明既有共识也有分歧。双方都认同数学不能只剩下答案。不同的是,数学家们更担心AI公司追逐解题成绩的方式会损害数学知识的积累与传承;而Liam则更乐观,认为随着能力提升,未来AI本身也能参与创造这些知识。网友联想到AlphaGo:它虽不会解释走法,人类棋手仍通过研究其落子学到东西。Liam赞同这一类比,并引用Noam Brown的判断:AlphaGo出现后人类棋手水平明显提高,数学领域或许也会出现类似变化。

前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了

9月11日,陶哲轩发布《人工智能在数学中的严重错位》,由25位菲尔兹奖得主共同署名,名单从1978年得主Deligne到2026年得主邓煜,几乎覆盖现代数学界最具代表性的一批顶尖学者。声明认为,当前AI公司将“解决著名数学难题”作为衡量模型能力的重要标准,与数学共同体追求概念理解、方法提炼和知识传承的目标存在严重偏移,甚至可能损害数学发展。具体强调五点:解出难题只是数学研究一部分,更重要的是理解结构、发展新概念新方法;答案需被理解才能成为共同知识;AI匆忙发布成果可能忽视前人贡献,带来成果归属与剽窃问题;培养学生过程不能被最终答案替代;AI有潜力促进数学,但如何使用至关重要。

这些担忧集中爆发,是因为AI做数学的能力已跨过新门槛。2024年AI突破还主要集中在IMO等竞赛数学,从银牌逼近金牌。2025至2026年,模型开始快速进入真正开放数学问题,陆续挑战Erdős系列问题、几何猜想、千禧年问题。今年5月,OpenAI内部模型反驳了已有近80年历史的Erdős单位距离猜想,构造出无穷多反例,并引入代数数论工具,被Tim Gowers等人称为“AI数学的里程碑”。9月初,OpenAI又宣布利用约1万个自主AI Agent配合内部高级模型,在约88小时内找到三维Navier–Stokes方程出现奇点的证明,并通过Lean形式化验证。若最终确认,AI面对的已不再只是“人类设计好的考试题”,而是困扰数学家数十年的研究前沿。

前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了

但当AI越来越像真正的“数学研究者”,新问题随之出现:成果算谁的?谁署名?模型从哪知道研究方向?9月初,纽约大学Tristan Buckmaster与Anthropic数学家Levent Alpöge公开一项流体方程奇点研究,OpenAI几乎同期宣布内部模型也完成相关证明。随后争议爆发,Buckmaster怀疑OpenAI得知其未公开方向后才开始攻题,双方围绕署名、优先权及模型是否接触用户数据发生争执。

问题绕回Liam回应陶哲轩之处。他相信随着AI能力边界扩展,“解决一道题”和“提供新思考方法”最终并不矛盾,未来AI可能既找到答案,也建立可被人理解、复用和发展的概念框架。但未来AI有能力产生洞见,并不能自动回答今天应怎样组织研究,让洞见被人理解和使用。当AI开始参与知识创造,这些知识如何产生、署名、被理解,又如何进入人类学术共同体,答案远未形成。

前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了

最近几家重要数学机构连续发声。美国数学学会强调,Navier–Stokes方程奇点问题的最新进展并非AI凭空完成,而建立在Navier、Stokes、Leray及近年Córdoba、Martínez-Zoroa、Buckmaster、Alpöge等几代数学家长期积累之上,并明确提出:数学的目的是人类的理解。伦敦数学会把AI定位成强大新工具:可加速探索和发现,但提出问题、创造新概念和形成真正数学理解仍是人的工作。克雷数学研究所对Navier–Stokes新证明未直接确认成立,而保持谨慎:结果仍需公开、同行检验和长期验证,并强调重大数学难题的价值从来不只是最后答案,还包括解题过程中产生的新思想、新方法和新理论工具。

所以,未来真正值得探讨的问题并不是“AI毁了数学”,而是当AI开始参与知识创造后,人类数学共同体该如何让这些由机器产生的新知识被理解、验证,并真正成为数学的一部分。Liam的话回答了未来,但更重要的可能是现在。

标签: AI 资讯 AI

更多推荐阅读

横扫四大榜单,DM0.5凭什么面面俱到?

横扫四大榜单,DM0.5凭什么面面俱到?

一个模型同时占据四个能力子榜单的榜首,这在具身智能行业里不多见。 RoboColiseum 由智元机器人发起,联合高校、科研机构、开源社区及机器人企业共同建设,把评测拆成四个维度:指令跟随、空间理解、扰动适应、通用操作。参评者只要在任何一个维度上有结构性短板,就会在对应子榜上掉下来。而原力灵机的通用具身基础模型 DM0.5 在四个子榜上全部排名第一,且目前是唯一做到这一点的模型。 具身评测行业...

2026-09-15
金融AI公司讯兔科技完成超3亿B轮融资,一年连融三轮

金融AI公司讯兔科技完成超3亿B轮融资,一年连融三轮

近日,中国金融AI领跑者讯兔科技正式完成超3亿元人民币B轮融资,过去一年内已连续完成三轮融资。本轮投资方覆盖险资、券商、公募、产业资本与头部投资机构,包括保险业国家级投资平台中保投资、广发信德,以及启明创投、琥珀资本、嘉程资本、信宸资本、钟鼎资本等新老股东,华兴资本继续担任独家财务顾问。融资后,公司将继续加大模型与产品技术投入,拓展多元资产客群,深化产业上下游协同,并稳步推进海外布局。 中保投资...

2026-09-15
北大团队重新定义端侧AI,元空智能跑进惠普预装

北大团队重新定义端侧AI,元空智能跑进惠普预装

静态互联网数据的增长红利已经见顶,下一轮模型能力的跃迁将越来越依赖与真实环境持续交互的“端侧”。从北大走出的元空智能(元空AI)给出这一判断,并重新定义端侧AI:生产力=元空端侧AI=模型×Agent×设备。端侧AI由此从“把模型搬下来”的单向链路,变成能自己转起来的飞轮。 三年前,元空AI靠国内最早一批AI Excel产品ChatExcel出圈,积累上百万用户。三年后,它从云端应用杀到本地端侧...

2026-09-15
仿真数据降本90%,虚时科技冲刺具身智能最后一公里

仿真数据降本90%,虚时科技冲刺具身智能最后一公里

2026年上半年,具身智能赛道融资超460亿元,人形机器人单价迈入“万元以内”。但行业面临真机数据太贵、太慢的瓶颈。近期测试显示,利用规模为真机数据5倍的仿真数据训练,可将机器人真实操作成功率提升40%,成本仅为真机数据的三分之一。业界共识日益清晰:要走向物理AI的GPT时刻,数据需求将超出大模型两到三个数量级,仿真成为通向拐点的关键路径。 国内初创公司虚时科技在底层技术上取得突破,将单个仿真场...

2026-09-15
半年6亿人追AI短剧,红果热播榜前99占77席

半年6亿人追AI短剧,红果热播榜前99占77席

3人核心团队,10万注册资金,半年连出十二季,保守估计利润600万,乐观2000万——AI短剧《万妖图录传》的爆发,正是行业缩影。年初红果APP才设AI剧独立入口,如今热播榜前99名中AI短剧独占77席,必看榜、热搜榜、收藏榜也全被“血洗”。爆款门槛水涨船高:去年播放量破亿可进年度TOP20,如今首日热度破亿的爆剧接二连三。出海同样凶猛,中国出品的AI短剧已占海外七成以上市场,圈内流传“3000块...

2026-09-15
7名博士生3个月从零训出7B大模型,代码数据全公开

7名博士生3个月从零训出7B大模型,代码数据全公开

北京中关村学院7名博士生用一个暑假从零训练出7B大模型ZGCM-1,并开放各阶段训练数据、配方、模型权重、训练代码、中间checkpoint和日志,供研究者追溯复现。在多项通用评测中,ZGCM-1与Qwen3-8B等同规模模型表现相近,部分数学推理和搜索评测中可与Qwen3-235B-A22B、GLM-5.1等更大模型比较。 七人背景分别为人工智能、网络、化学、生物和网安。他们因兴趣凑到一起,平...

2026-09-15
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部