北大数学系校友:OpenAI和Anthropic正在毁掉年轻人

北大数学系校友:OpenAI和Anthropic正在毁掉年轻人

AI 资讯 来源:新闻/公众号 发布时间:2026-10-06 更新于 2026-10-06 预计阅读 3 分钟

北大数学系校友:OpenAI和Anthropic正在毁掉年轻人

上个月,OpenAI和Anthropic开始极限内卷,接连宣布攻克数学难题,社交媒体陷入流量狂欢。我们跟进报道后,一位北大数学系校友表达了深深的忧虑。就在深谈次日,陶哲轩等25位菲尔兹奖得主联名发出公开信,主旨与谈话如出一辙。

在真正的数学研究者眼里,AI“解决”难题的逻辑荒谬且致命。攻克难题的最终目的不是结论本身,而是培养一代代人类数学家,在过程中产生深刻理解。如今AI给出的答案,是“被解决了,但完全没有被理解”。更可怕的是硅谷公司的宣传,正传递“不再需要人类数学家”的错误观念,吓退年轻人,误导经费决策者。

AI的“神迹”究竟多少是原创?一位研究员长期死磕冷门猜想,借助大模型辅助推演,结果访谈当天,arXiv上出现一篇论文,核心思路与其草稿几乎一模一样。作者是位搞物理的研究者,用AI跑出结果后直接署名挂出,如同“抽奖”。此事最终以联合署名收场,却揭示恐怖真相:人类与模型探讨的未公开草稿,正被AI公司拿去训练,再以“自主发现”形式吐出。此前AI解决纳维-斯托克斯方程,也被质疑窃取了纽约大学某教授的对话数据。他痛心总结:“你吸取了人类智慧的精华,却要毁灭产生了这种精华的Community。”

AI到底有没有独立发现新证明的能力?他举例,协和医生用优秀prompt让AI吐出全新证明,是因为“原料已经在那里了”,AI只是把文献线索串联起来。他自己苦想半年的猜想,问AI一问就问出来了,用的正是当年提出者用过的老办法。这不是超越人类的独立创新,只是对人类既有知识库的收割。

学术成果的Credit该给谁?他认为,数学成果本身客观存在,可以认可,但绝不能把奖励发给仅仅按按钮的人,必须对Understanding有所贡献才能获得荣誉。

人类社会为何要养活这么多数学家?绝大部分基础研究当下无用,只是未来科技爆发的理论备选,如今更沦为AI的“训练饲料”。但若因此停止支持,将是自杀。为保持人类社会还有人“懂数学”,必须维持一棵极高的数学知识树和庞大的人类数学家群体。必须允许他们干大量“没用”的事,没有庞大基数作为土壤,根本不可能诞生陶哲轩这样的顶尖天才。

理论数学家的出路在哪?他说,哪怕AI做数学比人类更好,人类也必须硬着头皮练自己的脑子。如今大模型本质仍是已知框架内的排列组合,深水区从0突破成本高昂。AI突破纳维-斯托克斯方程可能烧了2000万美元Token,足够雇100个人类顶尖数学家干一整年。人类大脑依然是能效比最高、最具颠覆性的“碳基计算集群”。

他讲了个黑色幽默:感谢合作者把论文写得晦涩,AI还没学会这个方向,他们还有一口饭吃。现有AI多基于文本符号训练,但几何、拓扑等依赖空间直觉的领域,数学家像描述一幅画那样论证,只能意会,AI学得并不好。只要人类大脑还在使用AI无法穿透的深层直觉,数学家就还有最后的阵地。

数学家们态度各异,有人全面拥抱AI,有人坚决拒绝将未完成草稿传到网上。数学宇宙浩瀚,AI攻克的不过是冰山一角。

标签: AI 资讯 AI

更多推荐阅读

Mistral发布1T参数大胖猫模型,激活仅49B

Mistral发布1T参数大胖猫模型,激活仅49B

今天早些时候,美国开源了 glm5.2 级别的模型。随后,欧洲的 Mistral 发布了 Mistral Large 4,又名 Le Chonk 大胖猫。 该模型总参数 1.05T,每次只激活 49B,另带一个 1.6B 的视觉编码器。它采用细粒度混合专家(MoE)结构,模型拆成很多“专家”,每处理一个词只叫醒其中一小部分,因此 1T 模型每算一个词的开销接近 49B 模型。原生多模态,能读文字...

2026-10-07
xAI联创宣判:数学两千年英雄时代落幕

xAI联创宣判:数学两千年英雄时代落幕

两千多年来,人类最聪明的大脑一直在攀登数学这片山脉。从欧几里得到怀尔斯,每征服一座山峰都要赌上一生。但xAI联合创始人Christian Szegedy认为,这个属于数学的英雄时代正在结束。 Szegedy在长文《数学何去何从?》中,将数学家比作丛林里徒手攀岩的探险家,AI则是一架飞机,已把旗插上没人爬过的山顶。孤独攀登者的时代正在结束,测绘整片大陆的时代正在开启。 Szegedy少年时在匈牙...

2026-10-06
OpenAI疯狂28天首日:模型提速50%却遭评论区翻车

OpenAI疯狂28天首日:模型提速50%却遭评论区翻车

Codex负责人Tibo宣布启动“疯狂28天”计划:未来28天每天要么交付一项Codex/Work改进,要么进行一次完整额度重置。第一天,Tibo宣布GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%,达到50TPS,覆盖官方订阅及Sign in with ChatGPT接入的第三方生态。 但评论区几乎无人关注提速,满屏冷嘲热讽。此前9月29日GPT-6.1 Sol上线后因负...

2026-10-06
AI研究员为何计划逃离湾区买地避难

AI研究员为何计划逃离湾区买地避难

一些Anthropic最期的员工,最近开始考虑在美国偏远地区买地。他们想过,如果AI真的失控,那里或许可以成为避难的地方。 “一切再也无法平静如初。”一些研究员的电脑上贴着同一句话。 事实上,逃离的念头并非突然出现。十多年来,一群聚集在旧金山湾区的AI安全研究人员,一直在讨论AI失控之后可能发生什么。那时候,Anthropic甚至还没有成立。 有人在伯克利设立共享办公空间,在私人Slack频...

2026-10-06
英伟达押注的Reflection开源新模型对标智谱

英伟达押注的Reflection开源新模型对标智谱

英伟达投资的 Reflection 发布首个开源模型 Beam,对标智谱 GLM-5.2。官方称两者在高级推理测试上分数相当,Beam 推理算力仅需后者的三分之一到四分之一。彭博和金融时报称其为美国在开源模型领域对中国的反击。但 Beam 与国内其他头部开源模型如 Qwen3.8、GLM5.3、Kimi K3、DSV4F 仍有差距。 Reflection 由谷歌 DeepMind 两位研究员 M...

2026-10-06
把35个判断交给内核:这个开源项目拿下黑客松总冠军

把35个判断交给内核:这个开源项目拿下黑客松总冠军

在进化酒馆黑客松深圳收官之战中,项目 mu(μ)获得全场冠军。它将 Jev 深度融合进 Harness,试图解决 Agent 把工具、日志、技能、上下文全部交给大模型导致效率低、Token 浪费的问题。 mu 建立在开源 Coding Agent pi 之上,主要改造模型外的 Harness,设计了 35 个判定点,覆盖用户输入、工具调用、上下文管理、任务完成判断和多 Agent 通信等环节。例...

2026-10-06
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部