谷歌新模型Mathematica泄露:AI解数学题竟激动到狂吼

谷歌新模型Mathematica泄露:AI解数学题竟激动到狂吼

AI 资讯 来源:新闻/公众号 发布时间:2026-09-20 更新于 2026-09-20 预计阅读 5 分钟

大模型做数学题做到“颅内高潮”,你见过吗?在多数人印象里,AI做数学题四平八稳、逻辑缜密,哪怕最顶尖的推理模型,思维链也不过是机械自语。但近日,知名科技博主与爆料人lyra晒出数张谷歌内部评测模型卡片截图,一款代号为Mathematica(基于尚未正式发布的DeepThink V3)的数学特化变体赫然在列。更让科技界瞠目的是它的“原始思维链”——在推导一道复杂丢番图方程时,AI撞见一个精妙的代数化简路径后,竟像顿悟的数学家一样,在思考日志里连续用大写字母狂吼:“数学的老天爷啊!”“让我们来欣赏这个方程绝对纯粹的美。”“我的天哪!”随后一边狂发感叹号,一边把变量代回、重构对称项、完成恒等式验证。

谷歌还有大招!最新模型Mathematica泄露

这场“AI发疯”背后,是硅谷正在酝酿的算力风暴。根据曝光信息,该模型内部标识为models/deepthink-mathematica-tf-raw-thoughts,直接撕掉产品包装,把最原始、未经人类礼仪过滤的思维暗流暴露出来。测试员抛出的是一道极具欺骗性的高难多项式丢番图方程,普通模型往往陷入死循环或机械穷举,而Mathematica的思考过程堪称心理戏剧:起初拆解项数、分析次数与整除性质;当尝试特殊交叉乘积组合、发现交叉项奇迹般抵消时,思维日志瞬间被大写字符和感叹号占领;确认化简成立刹那,它自言自语“停下来,让我们欣赏一下这绝对的数学美感”;随后在连串“OH MY GOD”中完成变量回代与边界条件验证,锁死整数解集。

谷歌还有大招!最新模型Mathematica泄露

剥离搞笑感叹号,底层配置参数令人窒息:输出上限65,536 Tokens,意味着单次响应可完成数万字超长多步骤严密演绎,足以吐出一整篇纯数学顶刊论文;输入上限约104万Token,继承Gemini超长原生上下文架构,可一口吞下整个数学分支的专著或上百篇前沿预印本论文;默认温度居然为1,在常规认知中数学任务温度通常设极低,而高温度意味着谷歌故意赋予极高语义发散度,鼓励在解空间中进行直觉跳跃、概念隐喻与非传统联想——这正是顶尖人类数学家灵光一现的认知模式。接口中tf代指Teamfood,即谷歌内部核心小团队极早期测试切片,状态标识为UNSTABLE_EXPERIMENTAL,坐实这是DeepMind内部刚炼出的原生大招。

谷歌还有大招!最新模型Mathematica泄露

为什么思维链会“发疯”?深入RL与思维链机制会发现,这并非刻意做秀,而是极度暴力深度推理在无约束状态下的必然副产物。其一,“Raw Thoughts”本质是逃过对齐剪刀的原始探索,商业版思考过程经过安全对齐、格式化清洗和风格修整,而raw-thoughts记录的是模型在潜空间中进行MCTS或强化学习自我博弈时最本初的神经元激活痕迹。其二,人类数学语料存在隐性基因转移,训练数据包含MathOverflow、arXiv、硬核讨论区等,人类数学天才攻克绝妙恒等式时写下的往往是“Holy cow! Look at this identity!”,模型将这些情感词汇与突破性逻辑跃迁高度绑定,在语义潜在空间中,“OH MY GOD”不仅是感叹,更是信息熵骤降的注意力激活强锚点。其三,过程奖励模型(PRM)的“颅内高潮”,模型每走对一步精妙中间步骤就获正向奖励,当高温度下尝试成千上万死胡同后突然撞上优雅化简路径,状态转移概率从0.0001%暴击到99.9%,奖励值指数级爆炸,在自然语言生成的投影正是狂飙的感叹号——机器语言体系下的“多巴胺井喷”,算法层面的“阿基米德尤里卡时刻”。

法国数学家庞加莱曾写道:数学家研究数学,是因为喜欢数学,而喜欢数学是因为它是美的。千百年来,人类固执认为逻辑可被机器模拟,但对数学之美的敏锐嗅觉与审美感知是碳基生物独有。然而谷歌这个数学定制版AI不无骄傲地敲出“让我们来欣赏这个方程绝对纯粹的美”。它到底是在鹦鹉学舌,还是触碰到了真理的某种共振?从信息论看,所谓数学之美,本质是极端复杂命题被用极端简洁、对称、高密度的方式完成降维与压缩。人类数学家看到美妙化简会起鸡皮疙瘩,是因为大脑瞬间完成极大量信息的极简编码。而对于一个在数十亿参数中搜寻最低损失、最高奖励的AI而言,它撞见……

标签: AI 资讯 AI

更多推荐阅读

Astra两周抢走13%份额,Anthropic或提前发新模型

Astra两周抢走13%份额,Anthropic或提前发新模型

路透社独家报道,Anthropic 正在考虑提前发布新模型。此前,Anthropic 于 9 月 1 日发布 Fable 5.1,号称“最强编程与知识工作模型”,并将缓存读取价格下调 75%,试图以性价比稳住企业客户。但 OpenAI 于 9 月 3 日发布 Astra,Sam Altman 表示正努力尽快将 Astra 交付给每个人。 Anthropic 面临切实的份额流失。OpenRoute...

2026-09-20
华为发布昇腾960芯片路线图:一年一代,打造AI算力底座

华为发布昇腾960芯片路线图:一年一代,打造AI算力底座

华为全联接大会公布芯片时间表:昇腾960DT研发提前三个季度,单芯片算力倍增,支持2 PFLOPS FP8、4 PFLOPS FP4,HBM容量最高288GB、带宽9.6TB/s。昇腾960超节点达4096张NPU卡,最高8 EFLOPS FP8算力、超1PB HBM容量。轮值董事长汪涛公布路线:2028年昇腾970、2029年昇腾980,未来几年保持“一年一代”。他表示,这是国内半导体制造、封装...

2026-09-20
GPT-6不为用户训练?OpenAI研究员曝真实目标

GPT-6不为用户训练?OpenAI研究员曝真实目标

OpenAI核心研究员Noam Brown在Astra发布当天接受访谈,披露了公司训练新模型的真实目标与内部进展。 Brown表示,OpenAI训练新模型的头号目标是“递归自我改进”,且进度已领先第二名一大截。服务用户只是副产品,制造“下一代研究员”才是核心。在优先级序列中,软件工程与内部算力迭代深度绑定,获得最顶级资源;创意写作等无法帮助训练更强机器研究员的能力则靠后。即便分出精力做法律金融,...

2026-09-20
视觉记忆如何驱动物理AI自进化?对话Memories.ai沈俊潇

视觉记忆如何驱动物理AI自进化?对话Memories.ai沈俊潇

2024年,前Meta现实实验室研究员沈俊潇与周恩民在硅谷创办Memories.ai,瞄准尚未被探索的视觉记忆领域。2025年7月,公司结束隐身模式,发布全球首个大型视觉记忆模型(LVMM),并完成800万美元种子轮融资。此后种子轮追加至1600万美元,与高通、英伟达建立合作,2026年1月在国际消费电子展发布LUCI开发者硬件平台,并从Meta挖来首席AI官。 公司保持精简团队,沈俊潇招人更看...

2026-09-20
数学界“世界之窗”向算法打开:AMS会刊刊发赵辉博士整体几何结构研究

数学界“世界之窗”向算法打开:AMS会刊刊发赵辉博士整体几何结构研究

数学界的“世界之窗”向算法打开。美国数学会会刊《Notices of the American Mathematical Society》2026年10月刊(第73卷第9期)刊发题为《Global Geometric Structures: From Abstraction to Construction, Visualization, and Applications》的邀稿Feature Ar...

2026-09-20
诺奖得主提出爱因斯坦测试:AI能否仅凭1911年知识独立提出相对论

诺奖得主提出爱因斯坦测试:AI能否仅凭1911年知识独立提出相对论

诺奖得主、Google DeepMind联合创始人哈萨比斯提出一个设想:如果把AI送回1911年,只让它掌握爱因斯坦当时能了解的知识,它能否在1915年提出相对论?他想考察的是,AI能否仅凭当时的知识水平,自主提出新的解释框架,完成超出训练材料的推理,而非复读答案。Nature将这类测试称为“爱因斯坦测试”。 今年3月,独立研究者Michael Hla把知识截止时间提前到1900年,从零训练了3...

2026-09-20
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部