OpenAI总裁证实另一千禧年难题获重大进展
上周,OpenAI宣布在纳维尔-斯托克斯方程相关问题上取得突破,引发全球关注。随后,联合创始人兼总裁Greg Brockman公开表示,在另一个千禧年大奖难题上也取得了重大进展。外界传闻称,OpenAI可能已实质性解决全部六个未解千禧年难题中的两道,并猜测在即将到来的开发者大会上,奥特曼与Brockman可能掏出“终极底牌”。

目前未解的千禧年难题包括:P与NP问题、黎曼猜想、杨-米尔斯规范场与质量间隙、霍奇猜想、贝赫和斯维讷通-戴尔猜想。此前有传闻称OpenAI可能接近解决霍奇猜想或BSD猜想,但科技界最关注的猜测指向P与NP问题。若AI解决P vs NP,将直接动摇现代密码学体系、算法极限及可验证问题的计算边界,非对称加密(RSA、椭圆曲线)之上的金融与互联网安全逻辑支柱将面临根本性重塑。即使不是P vs NP,任何千禧年难题被形式化证明破解,都意味着大语言模型从“概率文字补全”跃升为“科学级发现引擎”。

要理解“第二个难题突破”的震撼,需回看此前的“学术海啸”。克雷数学研究所2000年指定的七大千禧年难题,此前仅由佩雷尔曼攻破庞加莱猜想。纳维尔-斯托克斯方程作为流体力学基础,其三维空间内是否永远平滑、是否发生“有限时间爆破”始终无人能解。OpenAI的解题方式堪称降维打击:调集约10,000个高阶推理智能体,在88小时内持续推演,发送270万条消息,使用约1300亿个输出token,最终证明光滑流体会在有限时间内产生奇点,并用Lean完成形式化代码验证。过去一项世纪级定理需顶尖学者隐居十年、手写数百页草稿并经历数年同行评议,而AI智能体矩阵在四天内碾平了人类数百年未决的数学天堑。

与此同时,OpenAI卷入学界舆论风暴。因数百名数学家联名抵制,OpenAI被迫撤回对加州理工学院首届“数学黑客马拉松”的赞助。此前在纳维尔-斯托克斯问题上,NYU数学家Tristan Buckmaster与Anthropic数学家Levent Alpöge宣布三项证明,过程中使用了Codex和Claude。争议在于:Buckmaster声称成果公开前信息被传给OpenAI,OpenAI随后启动并行攻关,用未发布的新一代模型在约一周内消耗3000亿输出token并发布完整证明。Buckmaster称被OpenAI数学家Sébastien Bubeck施压,要求删除Alpöge署名,并受到语言威胁。他还担心其大量使用Codex的工作可能经训练数据影响OpenAI模型。对此,Brockman公开声明,最终解题模型的训练数据切断于今年7月初,完全在外部学者成果公开之前,OpenAI绝不会窥探或挪用私有数据。但他也抛出历史对比:当年怀尔斯为证明费马大定理秘密独行十年;而在AGI前夜,学者用公开弱版AI敲开缝隙后,拥有千倍算力、下一代私有模型的巨头能在几天内暴力推平整个长夜。这引发深层焦虑:未来科学大发现是否将沦为万亿算力帝国的特权?
大量科技迷为智力突破热血沸腾,NYU教授Scott Armstrong直言“奇点已经开始了,只不过分布极度不均”。但批评者诘问:AI证明流体力学奇点很酷,但患者在等待新的靶向抗癌药在哪儿?大多数人更需要AI攻克阿尔茨海默病、预测复杂蛋白突变、把新药研发周期从十年缩短到几个月。在全人类算力与电力资源极度紧缺的今天,数百亿美元顶尖超算应解开抽象猜想还是解决民生痛点?Brockman在访谈中吐露OpenAI内部残酷纠结:GPT-5.5发布前夕,为算力配额精打细算到每一行代码,痛苦削减每个接口的速率限制。但他坚信数学推演并非屠龙之技:千禧年难题是检验AI是否具备“超长链条严密逻辑与反幻觉能力”的最严苛试金石。一个能在大几十步推演中不犯逻辑错误、用Lean完全闭环自洽的系统,一旦迁移至分子动力学、基因工程与复杂靶点预测,救命能力将呈几何级数跃升。“这绝非脱离现实的游戏,”Brockman说,“正是在这种极端复杂问题的推演中,我们才能真正走向攻克绝症的那一天。”
更多推荐阅读

Anthropic首曝:3万AI智能体正自我迭代
Anthropic首次公开内部三大AI研发指标,揭示递归自我改进(RSI)正在其实验室真实上演。 第一项指标关于AI参与研发的程度。Anthropic依据Epoch AI六级自动化标准,对内部研发流水线进行评估。2026年7月,其随机抽取模型研发部门20%员工,用Claude研究智能体分析其Slack记录和内部文档,梳理出15000项研发任务、542个任务节点。截至2026年8月,Claude尚...
2026-09-18
智象新模型实测:视频生成开始理解真实世界
近几月,AI视频生成赛道持续升温。7月31日,Seedance 2.5与MiniMax H3同日发布;8月,阿里发布Wan3.0;9月,智象HiDream-O1-Video-1.0(简称HiDream V1)发布并冲上权威榜单全球前四。以字节Seedance、MiniMax H3、阿里Wan 3.0和智象HiDream V1为代表的中国模型,开始在全球主流榜单头部形成集群,从“单点领先”转向“多家...
2026-09-18
OPPO姜昱辰:大模型差距在缩小,AI手机差距才刚拉开
OPPO ColorOS 智慧产品研发总监姜昱辰给 AI 手机下的定义是:「以意图驱动的手机就是 AI 手机。用户说一句话,手机就能把事情办了,不需要再打开 APP、反复点击。」按此标准,包括 OPPO 自家产品在内,目前没有一台手机可称为 AI 手机。但做出这样的手机正是 OPPO 的目标。 OPPO 的答案是不与大模型公司争云端模型,把核心能力压在端侧,将手机做成真正的 Personal A...
2026-09-18
智谱10万国产卡两周让GLM优化自身推理系统
两周时间,10万颗国产AI加速器,一个开始优化自己的模型。智谱GLM首席科学家唐杰在X平台分享了一项关于GLM-5.3-Flash推理系统优化的研究。他透露,从GLM-5.3-Flash首次运行在国产AI加速器上,到完成全部生产流量承载,仅用了两周时间,系统端到端吞吐能力提升了3.2倍。最让唐杰印象深刻的是,完成大量优化工作的并非只有基础设施工程师,还有一个由GLM-5.3驱动的Infra Age...
2026-09-18
Manus拆分后首轮融资33亿 估值翻倍至268亿
据彭博消息,Manus正计划完成约5亿美元融资,估值有望达40亿美元,较此前20亿美元估值翻倍。知情人士称交易已接近完成,但仍处早期阶段,条款和投资者名单可能变化。这是Manus从Meta分拆后的首笔融资,若谈成将成为中国通用AI智能体赛道估值最高的公司。现有投资方包括腾讯、HSG和真格基金,未来可能效仿月之暗面寻求赴港上市。 Manus于2025年初在武汉和海淀成立,做AI智能体产品,邀请码一...
2026-09-17
Gemini 4 Pro疑伪装现身盲测,2M上下文泄露
今天上午,有用户在Code Arena的battle模式中抽到标着gemini-3.8-flash的模型,让其用HTML画一只鹈鹕骑自行车的2D SVG动画。结果鹈鹕有完整踩踏动作,背景会切换场景,嘴里还叼着一条鱼。将“鹈鹕”换成“提壶”后,生成的开水壶精骑自行车同样惊艳:壶盖冒热气,车后座绑着茶叶包,炉火温度和踏频都做成了可调控件。而正常3.8 Flash跑同一提示词,只出来一只方块拼成的静态鸟...
2026-09-17