奥特曼曝后Astra模型已超越全球顶尖数学家

奥特曼曝后Astra模型已超越全球顶尖数学家

AI 资讯 来源:新闻/公众号 发布时间:2026-09-18 更新于 2026-09-18 预计阅读 4 分钟

在和Salesforce CEO Marc Benioff的对谈中,奥特曼剧透了OpenAI内部模型的最新进展。他判断:“GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。”随后他曝出重磅消息:“在这个代号为Astra的模型之后,我们还有一个内部模型(Post-Astra)。它已经能够解决世界上最顶尖数学家都束手无策的难题。”OpenAI总裁Greg Brockman也表示:“我们还在另一个‘千禧年大奖难题’上取得了重大进展。”

爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

理论计算机界泰斗Scott Aaronson随后发布长文《奇迹与恐怖的时代》,宣告:“AI奇点已经开始了。人类数学家,已经被永远拉下了神坛。”过去评价大模型理科能力用的是高考、奥数题,如今OpenAI的标尺已变成“人类顶级学者”。GPT-5.5能日常推导公式、看懂前沿论文、批改高阶数学作业;GPT-5.6具备在一流学术期刊发表原创数学发现的能力;后Astra模型则超越全球最强数学家,不再是助手而是导师。

爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

上周,“纳维尔-斯托克斯方程”被突破的传闻已让数学界震动。OpenAI烧掉至少1500万美元算力,让AI推导出长达166页的证明,并通过Lean严格验证。人类数学家还没读懂,Brockman就宣布另一个千禧年难题也取得重大进展。目前未解的千禧难题仅剩五个:P与NP问题、黎曼猜想、杨-米尔斯规范场与质量间隙、霍奇猜想、BSD猜想。其中P与NP问题最令人恐惧——若AI证明P=NP,所有加密算法都可瞬间破解,物流、医疗、新药研发也能瞬间找到最优解。也有传闻称OpenAI可能已接近解决霍奇猜想或BSD猜想。

爆料!奥特曼自曝「后Astra」模型,已超越全球最强数学家

Aaronson在文中打出满屏“A”表达情感冲击,写道:“在我看来,奇点已经到来了……在剩下的岁月里,我大概再也不会去证明任何一个定理了。因为世界不再‘需要’我去证明。”他坦言信念彻底崩塌,并向AI末日论先驱Eliezer Yudkowsky致敬:“你关于文明最大挑战的预言是对的,而我和其他人都错了。”他提到哄孩子睡觉时胃里痉挛,13岁女儿半开玩笑说,如果想成为数学家,大概只剩下两周时间了。他用宗教比喻形容接受AI神明如同接受Jesus驾云重返地球。

Aaronson还列出“战报”:雅可比猜想的反例由Anthropic研究员靠AI模型Fable随手跑出;黎曼几何中格罗滕迪克常数的边界被极大改进;费马大定理在Lean中完成全面形式化验证;量子计算领域证明了Watrous的解缠结猜想等。他用《魔戒》攻城战形容学术圈:人类审稿人别无选择只能用AI审阅论文,否则防线瞬间被冲垮。未来论文如何署名?如果连证明过程人类都看不懂,数学研究的意义是什么?以陶哲轩为首的25位菲奖得主紧急发出抗议公开信,提出:我们是否即将失去数学的“人类性”?

面对这种绝望,硅谷和顶尖高校正发生“人才大逃亡”。无数天才物理学家、数学家,如普林斯顿高等研究院的Mike Winer,纷纷放弃学术前途,转投AI安全与对齐领域。因为他们意识到,在黑板上推导公式已没有意义。人类现在唯一且最紧迫的任务,是确保这个即将诞生的“机器神明”,不会在醒来的第一秒把全人类当成需要被抹除的Bug。

标签: AI 资讯 AI

更多推荐阅读

谷歌DeepMind成立AGI研究所,诺奖得主挂帅

谷歌DeepMind成立AGI研究所,诺奖得主挂帅

几周前,GPT-6 Astra横空出世,OpenAI首次官宣AGI实现。今天,谷歌DeepMind火速成立全新机构——DeepMind研究院(DMI),由Demis Hassabis、Shane Legg与James Manyika联手挂帅。以前的DeepMind只想搞出AGI,现在问题升级为:AGI真的来了以后,全人类到底拿什么接招? DMI专门研究“超级智能”对经济和社会的颠覆性影响,目标是...

2026-09-18
OpenAI前核心成员造出只会做选择题的大模型

OpenAI前核心成员造出只会做选择题的大模型

TypeSafe AI创始人Diogo Almeida曾是OpenAI核心成员,参与创造RLHF和InstructGPT,2024年初离职创业,两年后推出全新模型Jev。该模型只做一件事:高频决策。它无法聊天、写代码或生成文字,是纯粹的通用分类器。 开发者Marcel Pociot用Jev做了浏览器插件,过滤X上不想看的内容,如引战、加密货币、政治争论等。每条帖子Jev在后台判断是否命中分类,平...

2026-09-18
中国电信通用Agent杀入IDC实测前三

中国电信通用Agent杀入IDC实测前三

IDC发布国内首份《中国企业级通用Agent产品技术评估》,中国电信TeleAgent进入前三。此次评估未采用大模型Benchmark,而是用近百道非公开任务考察Agent在真实办公环境中的端到端执行能力。TeleAgent常规任务得分3.49分、复杂任务3.36分,九项能力中任务表现获满分,成本效率为评测最高分。该产品今年4月内部试用,7月推出V1.0,一个多月用户规模已接近120万。 IDC...

2026-09-18
1300张卡击败GPT-6!前OpenAI副总裁造出材料大模型

1300张卡击败GPT-6!前OpenAI副总裁造出材料大模型

前OpenAI研究副总裁Liam Fedus在X上发布Periodic Labs首个模型Periodic Neon:仅用1300张H200,加上数月实验数据,在自研XRD分析基准上超过GPT-6 Astra。Neon约1T参数,在134道高难度X射线衍射分析题组成的FrontierXRD上成功率达55.3%,领先GPT-6 Astra和Claude Fable 5.1。Astra据传总参数数万亿、...

2026-09-18
国产AI存储刷新全球纪录,焱融全栈布局曝光

国产AI存储刷新全球纪录,焱融全栈布局曝光

智东西9月17日报道,9月1日,MLCommons发布MLPerf Storage v3.0基准测试榜单。焱融全闪AI存储F9000X在多项测试中拿下第一,验证其在极限AI训练负载下对高速网络带宽的高效利用能力。 随着AI从模型训练走向规模化推理,存储需处理的数据和任务持续增加。训练阶段要持续向GPU供给海量数据,并快速保存和恢复模型Checkpoint;推理阶段需管理不断膨胀的KV Cache...

2026-09-18
AI短片斩获威尼斯双奖,千万级创作大赛开启

AI短片斩获威尼斯双奖,千万级创作大赛开启

十天前,AI超创DiDi_OK的《网站》在2026年威尼斯Reply AI Film Festival上斩获评审大奖与观众选择奖双料大奖。该片从76个国家3100多部作品中脱颖而出,评委包括奥斯卡得主和《狮子王》联合导演。影片用十来分钟探讨“观看能否改变现实”,凭借画面与叙事功力成为本届唯一同时获得两项大奖的作品。这类会讲故事的AI创作者,正是当下AI行业最稀缺的人才。 今天,虎鲸文娱集团正式启...

2026-09-18
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部