陶哲轩为何突然转向AI减速派?
曾最爱AI、逢人就安利AI工具的陶哲轩,一夜之间转向AI数学的对立面。在SAIR最新演讲中,他公开向模型公司开火:AI公司无休止加速,却对后果一无所知,必须慢下来,完全没理由这么快。感受到危机的远不止他一人,菲尔兹奖得主Cédric Villani在看到OpenAI拿下千禧难题后直言“大受震撼,简直跟世界末日一样”,而仅3个月前他还称LLM根本没有智能、只是统计学复读机。

就在几个月前,陶哲轩还是硅谷推崇的“AI课代表”,早早将AI嵌入科研工作流。2026年3月他在IPAM会议上呼吁同行别太死板,称AI在数学和理论物理领域已“ready for primetime”;同月接受《MIT科技评论》专访时断言数学正经历一场哥白尼革命;春节前接受采访时还表示未来连初中生都能借助AI+Lean对数学前沿研究做出贡献。然而半年后画风突变,他在SAIR演讲中直接喊话模型公司:别解数学问题了,这又不是世界危机,慢一点。

陶哲轩用灯塔比喻未解决的数学问题:大多数人出海不是为了灯塔所在地,但灯塔照亮整片海域,让人们安全航行。数学家的职责不只是解决困难猜想,因为解决本身基本没有直接实用价值,治不了癌症、攻克不了核聚变。真正珍贵的是研究过程中沿途建立的工具、理论框架和洞见。他指出数学证明的正常生命周期有五个环节:提出解答、机械验证(如Lean检查通过)、阐释工作、同行评审、写入教科书。AI如今在前两步疯狂加速,后三步——理解、消化、写教科书——进度几乎为零。AI不停碾压重大猜想,却没人做报告、写论文,甚至按下回车生成证明的人都搞不明白发生了什么,结果是一场前所未有的知识拥堵。他称之为“Proof Indigestion(证明消化不良)”,并比喻为20世纪初汽车突然涌入为行人和马车设计的街道,造成全面拥堵瘫痪。

陶哲轩补充,这可能不是模型公司本意,他们想干也没办法,因为AI做不了洞见——洞见不可验证、刷不了分,很难被当做目标函数训练。但他指出长此以往会埋下巨大隐患:一是数学家创造力丧失,新的数学问题与前沿方向往往诞生于撰写教材时的查漏补缺或漫长思考中的偶然发现,AI直接跳向最终答案,抹杀了漫步式探索带来的灵感;二是数据污染,现在AI数学厉害是因为吞噬了人类几个世纪写在教科书里的精华,若未来学术界充斥海量AI生成、人类无法理解的证明,下一代AI再吃这些数据训练会怎样?他用生物学“克隆小鼠”故事类比:克隆技术本身有损耗,端粒缩短、表观遗传印记丢失、体细胞突变累积会逐代叠加,最终后代发育异常、存活率下降甚至活不下来。因此他认为AI公司一股脑把证明丢出来非常不负责任。
陶哲轩的态度转变早有草蛇灰线。他牵头联合Peter Scholze、邓煜及Pierre Deligne等25位菲尔兹奖得主联名写公开信,炮轰OpenAI等模型公司,大意是AI公司不能把数学打benchmark刷,这与数学界追求的目标严重错位,数学研究真正珍贵的是推导过程中的“认知摩擦”,光靠大力出奇迹量产True/False会毁掉思想生长的土壤。此后他又在个人网站写博客详细探讨。
面对25位菲尔兹奖得主的集体抗议,OpenAI终于官方回应,宣布成立设在普林斯顿高等研究院(IAS)的独立顾问小组“数学与人工智能顾问小组”,名单包括Edward Witten、Timothy Gowers、Martin Hairer、Melanie Matchett Wood、Camillo De Lellis等顶级大佬。OpenAI表示小组将为新兴研究成果的审查和传播提供建议,帮助评估重要性、协调传播方式。但官方声明白纸黑字写着:顾问小组将不负责就数学上的内部进展提供建议。评论区网友也鲜有人共情数学界,多是幸灾乐祸玩梗,最扎心的灵魂三问是:画家倒下时,陶哲轩在哪?作家倒下时,陶哲轩在哪?程序员倒下时,你陶哲轩又在哪?
更多推荐阅读

OpenAI一次公开722份数学手稿
10月7日,OpenAI在GitHub上线openai/math仓库,一次性发布722份手稿,归入372个问题家族,涵盖乘法函数、π的无理性指数、马勒猜想、黎曼zeta函数零点区域、海森堡铁磁体自发磁化、自由群因子同构等领域。仓库分三层:preprints目录放PDF和源文件,lean目录放Lean形式化证明,reasoning_traces目录放模型推理过程摘要,并公开10份推理摘要。OpenA...
2026-10-07
AI几年内或超越所有人类?Anthropic研究员预测
Anthropic强化学习技术负责人Sholto Douglas在8月录制、10月2日上线的访谈中表示,能力等于甚至超过所有人类的模型,很可能在未来几年内出现。他设想AI能完成人类在电脑上做的所有工作,把原本需要几个世纪的科技进步压缩到一二十年。他推算,2028年AI年度资本开支可能达4万亿美元,全球GDP可能在2030年代初翻倍,届时地球上每个人都能享有连今天首富也无法拥有的富足。同场研究员Ni...
2026-10-07
全球最大AI影视公司如何用模型拍电影
AI 视频已能生成足够像电影的镜头,但真正的 AI 电影仍很少。一旦进入长篇制作,角色一致性、镜头衔接、表演控制和团队协作都会成为问题。国内常见的 UGC 和 ProC 路线把编剧、导演、分镜、剪辑甚至制片压到一个创作者身上,AI 提升了个人效率,却没有把专业人群组织成生产线。ProC 的上限往往是模型的上限,影视公司的上限才可能是人的上限。 在 Artificial Analysis 最新有声...
2026-10-07
DeepSeek Harness兼容Claude Code Mods,作者回应
10月1日,Claude Code发布Mods,插件作者可用函数钩子改写提示词、拦截工具调用、在终端绘制界面。10月3日,DeepSeek Harness(DSH)发布v0.2.1-alpha.1,更新之一是实验性的Claude Code Mods兼容层。知乎随即出现相关讨论。10月4日下午,兼容层作者、DSH组崔添翼作答,明确“一切皆插件”与开源一样,是立项之初就定下的方向,不是被迫或模仿。 ...
2026-10-07
Claude用Lean严格验证,攻克菲尔兹奖得主数年未解的渗流猜想
2026年8月30日,菲尔兹奖得主Hugo Duminil-Copin发文感叹,他倾注数年心血、屡败屡战的渗流猜想,恐怕迟早会被AI攻克。几乎同时,同行在GitHub上发现Anthropic工程师提交的代码仓库,其中是由大语言模型Claude生成、并经Lean严格验证的完整证明——困扰人类近70年的连续相变猜想已被AI证明。没有发布会,没有官方博客,消息传出后全球数学界震动。德国数学家Benedi...
2026-10-07
OpenAI启用文本水印,幕后推手是统计学诺奖得主
今天,OpenAI 宣布正式启用文本水印。即日起,全球 API 客户可为部分模型自行开启水印,默认仍关闭。未来几周,欧盟地区符合条件的 ChatGPT 与 Codex 文本输出将加上肉眼不可见的水印,覆盖所有付费档位。检测器仅向通过审核的研究者和专业机构开放申请,暂不面向公众。 直接推手是欧盟。《人工智能法》第 50 条自 2026 年 8 月 2 日起适用,要求生成式 AI 提供方以机器可读方...
2026-10-07