黄仁勋宣布AGI已至,评测机构当场拒签
上周四,OpenAI发布GPT-6 Astra,官网称其为“世界上最智能、最对齐的模型”。随后黄仁勋在X上发帖称“AGI已经到来”,但OpenAI官方发布页并未出现“AGI已实现”字样。
OpenAI称Astra在ARC-AGI-3上拿到99.9%,饱和了该基准。但负责出题的ARC Prize基金会当天发文拒签,指出该分数来自OpenAI定制测试环境,换成对所有厂商一视同仁的标准环境,最高分仅62.7%。ARC Prize结论是:Astra在泛化上有实质进展,但不宣称它是AGI。

OpenAI总裁Greg Brockman在记者会上说“欢迎来到AGI时代”,并预言AGI诞生“可能就是这个模型”,但随即限定为“个人判断”,称AGI是灰色模糊概念,“由用户自己决定”。CEO奥特曼此前曾吐槽AGI是定义糟糕、接近营销术语的词。
ARC-AGI-3榜单显示,Astra两套环境成绩分开标注;同榜Claude Opus 5为30.2%,GPT-5.6 Sol为7.8%。在定制环境下Astra考了99.9%,花费近1.9万美元;标准环境下最高62.7%,成本升至2.6万美元。ARC Prize承认Astra带来“阶跃式”惊喜,在96%关卡中动作数比人类少,平均少用51.7%,但强调刷满该基准不等于证明达到AGI。

黄仁勋帖子提到三个数字:Astra在约10万颗NVIDIA Grace Blackwell NVLink72上训练;从ChatGPT到o1再到Astra只用了4年;“接下来还有40万颗GPU上线”。这构成商业叙事:10万颗GPU砸出Astra,40万颗会砸出什么?AGI由此变成算力需求证明。
去年10月OpenAI与微软协议规定,OpenAI宣布AGI后需由独立专家小组核验。今年2月双方重申合同里AGI定义和认定流程不变。4月协议修订,微软收入分成改为“与OpenAI技术进展无关”,外界解读AGI条款对商业利益触发作用大幅弱化。Brockman、黄仁勋的表态和跑分,都不构成合同意义上的AGI认定。OpenAI正筹备IPO,Anthropic也在冲刺上市,AGI牵动股权定价和商业控制权。

Bloomberg长文指出,AGI定义无人说了算。OpenAI定义为“在大多数具有经济价值的任务上超越人类的系统”;谷歌DeepMind 2023年论文看通用性;ARC Prize称经济价值是错误尺度,定义为“能高效习得训练数据之外新技能的系统”。Anthropic的Dario Amodei改叫“强大人工智能”,微软的Mustafa Suleyman造了“可用人工智能”,Meta和OpenAI直接谈“超级智能”。时间表也混乱:奥特曼2024年9月称“几千天内”可能有超级智能,一年后承认“还缺一样相当重要的东西”;DeepMind的Shane Legg押2028年前实现AGI概率50%,Demis Hassabis却说还要五到十年,时间线缩短只因“AGI定义正在被稀释”。
模型公司晒跑分不下定论,芯片巨头急着宣布时代降临,基准机构咬住底线不承认,大金主按合同算账。过去四年全行业争谁最先做出AGI,最近叙事时态从“还要一到三年”跳到“已经到来”,但一套公认的AGI验收标准至今没人拿得出来。
更多推荐阅读

地瓜机器人具身智能负责人离职,加入工业具身新公司
场景落地成重要考量,具身人才开始流向工业赛道。 AI科技评论独家获悉,地瓜机器人具身智能负责人何泳澔已离职并加入具身赛道新公司,预计近期将对外官宣。 公开资料显示,何泳澔为中科院自动化所模式识别与人工智能博士,长期深耕机器人感知、具身智能策略算法领域,在轨迹数据处理、机器人策略学习方面有多项技术积累与专利成果。任职地瓜机器人期间,何泳澔担任具身智能负责人,主导具身 VLA/VA 模型、机器人视...
2026-09-11
国产万卡算力爆发,科大讯飞让AI反哺算力
最近几个月,国产 AI 算力开始密集跨过新的数量级。7 月,全国产十万卡 AI 超集群落成;9 月初,无锡国产万卡级智算中心一期 2000 张摩尔线程 MTT S5000 GPU 智算卡全部投入运行,集群算力需求基本达到满载;国产卡正进一步向万卡乃至十万卡级训练基础设施迈进。 集群规模越来越大,新问题也随之而来:这些芯片究竟能发挥出多少实际训练能力?大模型训练中,卡数增加会推高系统复杂度。单芯片...
2026-09-11
百度AI营销三件套升级:从做图到管ROI全包了
广告主已不再纠结是否用AI生成素材,而是研究如何借AI提升投放量、降低获客成本。北京一家律师事务所接入百度营销擎舵图片Agent后,AI生成素材在投放中占比达70%,转化成本下降19%。 百度营销正式发布擎舵3.0营销创意智能体,并升级AIMax和AI投放助手。擎舵3.0负责生产和裂变创意,AIMax将素材放入真实流量测试,AI投放助手定位问题,投放结果返回创意端影响下一轮生成,形成闭环。 目...
2026-09-11
90后发Nature,高中生进ICML:AI正在折叠科研
假如你吃了个鸡蛋觉得不错,何必认识那只下蛋的母鸡?钱钟书这句名言,在今年外滩大会有了AI版本:当你读到一篇好文章,解决了疑问,也学到了东西,它究竟是人写的还是AI写的,还重要吗? 提出这个问题的是北京大学博士生吉嘉铭,上届蚂蚁InTech奖得主。他还预测:学术Conference一定会消失。同一舞台上,三院院士Michael I. Jordan也聊到学术会议,但视角不同。他说,今天的会议和论文越...
2026-09-11
银行AI Agent上岗:4200万小微商家聊天框里办贷款
过去只有大企业才有的专属金融服务,AI Agent正在把它送到小微经营者的聊天框里。一个小微商家想开第二家餐饮店,在聊天框说了句“想把额度提一提”,10分钟后拿到一笔40万、可按开店进度分笔支用的融资方案。速度背后,通常是一个标准化产品,额度不会太大,方案也不贴合具体生意。如今终于有个性化的解决方案了。这是网商银行在2026外滩大会上首次披露的AI银行落地进展:后台AI全面进入风控、人审、营销、产...
2026-09-11
Anthropic承认对齐缺陷:超级智能尚无解
研究员Jacob Coxon宣布从Anthropic离职,公开指责OpenAI和Anthropic正冲向能自我改进的超级智能,拿所有人生命冒险。他加入Anthropic仅数月,放弃可能因公司上市带来的巨额股权收益也要离开。该帖浏览量超1.3亿,WIRED、WSJ等媒体跟进报道。 Anthropic对齐科学负责人Evan Hubinger回应称,Jacob说得对,未来十年内AI导致人类灭绝的概率超...
2026-09-11