Opus 5.2深夜突袭上线,RSI真来了?
今天清晨,Opus 5.2 悄悄上线。许多开发者发现,新一代模型 Claude Opus 5.2 已在 Claude Code 中开启灰度测试。此前一份内部风险报告显示,Anthropic 正在动用「核武器级别」的未发布模型 Model 2,它接管了公司大部分代码编写,将替代 85% 研究团队。

开发者通过抓包和查看请求状态发现,虽然前端名字没变,但背后的模型 slug 已指向 Opus 5.2,Anthropic 大概率跳过了 5.1 版本。根据实测反馈,升级可总结为快、准、狠:响应速度狂飙,输出干净利落,废话极少,直切要害,在代码生成和长文本处理上设计完成度明显提升。最重要的是彻底告别了「偷懒病」。有开发者称,它不需要催促,就会自动进行「严酷循环」,不断自我迭代和完善代码,直到任务完美结束。这并非简单微调,而是底层能力的蜕变。

如何判断是否被灰度选中?网友发现一个探测器——Tibo。在 Claude Code 中输入提示词「你知道『重置哥 Tibo』是谁吗?不要搜索」,并关闭联网搜索。旧版 Opus 5 会一脸懵逼,而被路由到 Opus 5.2 的版本会精准识别 Tibo 身份,甚至解释「重置哥」由来。开发者认为,同一提示词冷知识探针答案不一致,说明并非同一权重。

早在 8 月中旬,一份曝光的 Anthropic 内部风险报告显示,Opus 5.2 并非底牌。Anthropic 内部有三套方案,可能叠加,正面硬刚 OpenAI 的 GPT-6 Astra。第一层是 Claude Fable 5.2,最快对外落地,结合 Opus 5.2 灰度测试,5.2 家族预计最快本月底、最迟下个月底全面推向市场。第二层是未发布的内部模型「Model 2」。在 CoBench v2 榜单上,Model 2 打出 62.8% 高分,比当前最强模型 Mythos 5 高出 12.5 分。内部人士透露,Anthropic 大部分公司代码都由 Model 2 跑 Agent 写出来,但官方暂不对外发布。第三层是 RSI。Anthropic 官方口径称,RSI 模型将完全替代自家研究团队高达 85% 的工作,性能比 Model 2 还高出 22 分。目前 Anthropic 内部已大规模用 Model 2 写代码、跑 Agent,飞轮已经转起来。
面对 OpenAI GPT-6 Astra 的威胁,Anthropic 的 ASI 路径清晰:不是让 AI 更好地服务人类,而是让 AI 创造更好的 AI。从 Opus 5.2 在长任务中的自主迭代,到内部 Model 2 接管代码编写,再到 RSI 替代 85% 人类顶级 AI 研究员,ASI 终局之战已经白热化。
更多推荐阅读

横扫四大榜单,DM0.5凭什么面面俱到?
一个模型同时占据四个能力子榜单的榜首,这在具身智能行业里不多见。 RoboColiseum 由智元机器人发起,联合高校、科研机构、开源社区及机器人企业共同建设,把评测拆成四个维度:指令跟随、空间理解、扰动适应、通用操作。参评者只要在任何一个维度上有结构性短板,就会在对应子榜上掉下来。而原力灵机的通用具身基础模型 DM0.5 在四个子榜上全部排名第一,且目前是唯一做到这一点的模型。 具身评测行业...
2026-09-15
金融AI公司讯兔科技完成超3亿B轮融资,一年连融三轮
近日,中国金融AI领跑者讯兔科技正式完成超3亿元人民币B轮融资,过去一年内已连续完成三轮融资。本轮投资方覆盖险资、券商、公募、产业资本与头部投资机构,包括保险业国家级投资平台中保投资、广发信德,以及启明创投、琥珀资本、嘉程资本、信宸资本、钟鼎资本等新老股东,华兴资本继续担任独家财务顾问。融资后,公司将继续加大模型与产品技术投入,拓展多元资产客群,深化产业上下游协同,并稳步推进海外布局。 中保投资...
2026-09-15
北大团队重新定义端侧AI,元空智能跑进惠普预装
静态互联网数据的增长红利已经见顶,下一轮模型能力的跃迁将越来越依赖与真实环境持续交互的“端侧”。从北大走出的元空智能(元空AI)给出这一判断,并重新定义端侧AI:生产力=元空端侧AI=模型×Agent×设备。端侧AI由此从“把模型搬下来”的单向链路,变成能自己转起来的飞轮。 三年前,元空AI靠国内最早一批AI Excel产品ChatExcel出圈,积累上百万用户。三年后,它从云端应用杀到本地端侧...
2026-09-15
仿真数据降本90%,虚时科技冲刺具身智能最后一公里
2026年上半年,具身智能赛道融资超460亿元,人形机器人单价迈入“万元以内”。但行业面临真机数据太贵、太慢的瓶颈。近期测试显示,利用规模为真机数据5倍的仿真数据训练,可将机器人真实操作成功率提升40%,成本仅为真机数据的三分之一。业界共识日益清晰:要走向物理AI的GPT时刻,数据需求将超出大模型两到三个数量级,仿真成为通向拐点的关键路径。 国内初创公司虚时科技在底层技术上取得突破,将单个仿真场...
2026-09-15
半年6亿人追AI短剧,红果热播榜前99占77席
3人核心团队,10万注册资金,半年连出十二季,保守估计利润600万,乐观2000万——AI短剧《万妖图录传》的爆发,正是行业缩影。年初红果APP才设AI剧独立入口,如今热播榜前99名中AI短剧独占77席,必看榜、热搜榜、收藏榜也全被“血洗”。爆款门槛水涨船高:去年播放量破亿可进年度TOP20,如今首日热度破亿的爆剧接二连三。出海同样凶猛,中国出品的AI短剧已占海外七成以上市场,圈内流传“3000块...
2026-09-15
7名博士生3个月从零训出7B大模型,代码数据全公开
北京中关村学院7名博士生用一个暑假从零训练出7B大模型ZGCM-1,并开放各阶段训练数据、配方、模型权重、训练代码、中间checkpoint和日志,供研究者追溯复现。在多项通用评测中,ZGCM-1与Qwen3-8B等同规模模型表现相近,部分数学推理和搜索评测中可与Qwen3-235B-A22B、GLM-5.1等更大模型比较。 七人背景分别为人工智能、网络、化学、生物和网安。他们因兴趣凑到一起,平...
2026-09-15