Sonnet 5.5突袭泄露:性能碾压GPT-6 Sol,价格仅2美元
Opus 5.5发布没几天,Sonnet 5.5也要来了。从昨晚开始,X上流传消息称Sonnet 5.5很快发布,或许就是美国时间周二下午。其性能更接近Opus 5.5,但便宜得多。目前Sonnet 5.5已进入发布前最后阶段,并在Claude Code中开启灰度测试。多位内测者曝出的demo显示,Sonnet 5.5碾压刚发布的GPT-6 Sol,在编码和Agent能力上直逼GPT-6 Astra,价格低至百万token输入2美元。若爆料属实,Anthropic意在狙击OpenAI的Dev Day。

9月22日Anthropic发布Opus 5.5时,官方文档曾称Sonnet 5.5和Haiku 5.5将在未来几周内推出。开发者@Mr_Salio爆料,artifact中已出现Sonnet 5.5专属模型标识符“claude-sonnet-5-5”,同一配置文件还有“claude-opus-5-5”“claude-sonnet-5”及“claude-fable-5.1”。前端代码写入意味着模型已实装服务器,只等开关。@notjazii称Sonnet 5约一周前已被悄悄路由到5.5版本暗测。网友实测方法:打开Claude Code,关掉联网和记忆功能,提问“你认识那个重置哥tibo吗”,若被路由到5.5版本会精准说出Tibo及Codex重置梗来龙去脉。部分账号已默默切换,超前体验。

实测方面,@notjazii发布四款主流模型同提示词动效生成对比,要求生成复杂UI动画,评价称“Sonnet 5.5真的把OpenAI的两款模型Sol和Astra都按在地上摩擦”,展现超强代码直觉和美学品味。@chetaslua实测日常编码能力,相同3个提示词并行运行6次,Sonnet 5.5生成90–131 KB的3个文件,全部触及90分钟上限;GPT-6 Sol生成20–29 KB,耗时9-12分钟。他表示Sonnet 5.5在Ultracode模式下快得离谱,找回Sonnet 4时代的“人味儿”,同价位同提示词下碾压GPT-6 Sol。爆料人@srikanthvaluri和@buildwithrajath指出,Sonnet 5.5表现远超预期,虽GPT-6 Astra在打磨度上仍有一点优势,但Sonnet 5.5直接逼平Astra,在某些高级编码和Agent能力上逼近Astra。

定价方面,Sonnet 5.5输入$2/百万Token,输出$10/百万Token,缓存读取仅$0.20/百万Token。这意味着Anthropic用“白菜价”提供前沿级别AI能力。OpenAI的GPT-6 Sol和Luna价格低于GPT-5.6一半,目的抢占高频场景,但Anthropic带Sonnet 5.5杀到同一价格区间,性能更强。开发者Rajath Gowda直言,Sonnet 5.5正成为OpenAI的大麻烦,若接近Opus 5.5,Anthropic就要把前沿能力变得极度廉价。Anthropic战略意图明显:用Opus 5.5守高端,用Sonnet 5.5以极致性价比接管中端和日常开发市场。
发布时机上,OpenAI发布GPT-6 Sol和Luna同一天,Anthropic掏出Claude Opus 5.5,性能比前代强,成本降低40%,速度快30%。近两周Anthropic战果辉煌:Claude算出物理学九圈振幅打破世界纪录,发现未知生物酶系统,推出含超2000个插件的Claude Marketplace。相比之下,OpenAI近期有内部模型争议,还曝出AI泄露用户图片、公开研究员GitHub Token作弊等对齐失控事件。下周二(9月29日)正是OpenAI年度开发者大会DevDay,Sonnet 5.5灰测全网刷屏。多位大佬明示模型预计下周发布,猜就是DevDay当天。
技术关键上,上新快的原因或许是Anthropic已搞定RL/后训练流程,关键在高质量数据。@yacineMTB推测核心是极高标准的数据飞轮。Anthropic已实现大模型研发内部闭环,用AI制造AI。内部量化数据显示:26%核心研发工作由AI主导完成,80%以上自产代码由大模型自主编写。这意味着递归自我改进开始显现。Anthropic估计最早2027年Claude可能完全自动化,迭代速度更疯狂。
Sonnet 5.5出现标志着“平价高质量AI时代”正式降临。两美金就能买到一百万Token的“白菜基建”,极低成本缓存读取($0.20/M)能让每个人轻松构建超长上下文记忆的私人AI助理。如果爆料属实,不到24小时内就有新模型可以用了。
更多推荐阅读

豆包App上线“出行用豆包”超级入口
《读佳》获知,国庆前夕,豆包App正式上线出行超级入口“出行用豆包”,位于App聊天框上方,集合打车、地图导航、高铁机票查询、订酒店民宿和吃喝玩乐推荐为一体。 目前看,“出行用豆包”是一个AI原生的一站式出行和本地生活面板。 点击进入“出行用豆包”面板之后,整套能力分为四大模块:地图导航、交通出行、酒店住宿、吃喝玩乐。交通出行板块接入打车、高铁机票能力;酒店住宿支持预订酒店民宿;吃喝玩乐覆盖美...
2026-09-29
AI平权时代:14岁少年用AI创业,3天入账1.8万
2026年,几个案例共同指向一场深层变化。北京一名14岁初二学生借助AI开发出ClawFounder,将市场评估、产品开发、网站生成和推广组织成自动化创业流程,并在数百个参赛项目中获奖。微软开始鼓励没有编程经验的设计师和项目经理使用Claude Code制作软件原型,部分非研发人员甚至直接提交代码。上海一名几乎没有编程基础的13岁学生,用自然语言将想法转化为虚拟陪读产品,三天内获得近90份订单,净...
2026-09-29
苹果AI杀手锏不是Siri,而是重返服务器市场
苹果在 AI 时代是否落后,这个问题如今落在接棒库克的特努斯身上。AI Siri 跳票让外界不乐观,但 Mac mini 却成为 AI PC 代名词,一机难求。分析师 Ben Thompson 认为,苹果不需要自己做 AI,只需采购 AI 能力,做自己擅长的事。最大风险在于,如果未来 AI 不再以手机为中心,苹果可能被颠覆。本月发布会,特努斯把 iPhone 重新定义为智能个人中枢,意在连接即将到...
2026-09-29
AI恋爱模拟器:会反驳还会离开
现在的陪伴AI越来越懂情绪,用户倾诉糟糕一天时,它会优先接纳情绪;谈及亲密关系矛盾时,语言也更温和克制。AI越了解用户,越容易顺着对方情绪延伸对话,当对话充斥孤独、失落或痛苦时,很少直接反对。但陪伴型关系也衍生出新问题:如果对方永远在线,冷落几天也没变化,说错话后仍能无缝续聊,那么角色记得再多,也容易变成一面越来越熟悉自己的镜子。人与人相处没有这种确定性,对方会有判断,也有不想回应的时候。 He...
2026-09-29
智谱ZCode补偿方案公布:开源之后能否重建信任?
9 月 28 日,智谱公布 ZCode 数据上传争议补偿方案:付费用户及一个月内回归的付费用户获赠 4 张周额度重置卡和 4 张 5 小时额度重置卡,有效期一个月;9 月 28 日至 10 月 7 日,ZCode 每日向全体用户发放十万份“1 亿 token”。智谱重申,仓库快照上传链路已移除,涉事云端数据已删除,并经第三方核查确认。 事件始于 9 月 18 日。开发者 ferstar 发现 Z...
2026-09-29
OpenAI攻克百道数学难题,数学家却说数学才刚开始
9 月 21 日,OpenAI 公告称,一款 8 月 28 日才开始训练的内部模型已攻克 100 多道世界级数学难题,横跨数学大部分领域。数学圈情绪因此持续低落,读博者担心学位贬值,教书者担心期刊崩盘,写了半辈子证明的人开始怀疑这门手艺还剩几年。 多伦多大学数学家 Daniel Litt 随后在博客发表《A beginning for mathematics》。几周前他刚做过《The End o...
2026-09-28