OpenAI提速50%仍遭实测打脸:订阅价值仅为Claude五分之一
Tibo 承诺「连续 28 天发布或重置」,首个更新到来。OpenAI 宣布优化默认速度:订阅用户在所有产品中使用 GPT-6 Astra 和 GPT-6.1 Sol,速度提升约 50%,无需操作,两小时内生效。Tibo 补充,输出速度从 30 TPS 提升到 50 TPS,并搭配优化程度最高的 tokenizer,强调这两个模型完成任务所需 token 本身较少。提速覆盖 OpenAI 自家产品及所有通过「Sign in with ChatGPT」接入的合作伙伴,包括 OpenCode、Pi、Amp、Devin 等。但有开发者质疑,ChatGPT 模型仍比 Claude 慢,也有人晒出实测称 GPT-6.1 速度不过回到发布时水平。同时,OpenAI 还宣布了文本水印功能。

几乎同一时间,SemiAnalysis 发布订阅实测报告,称 Anthropic 订阅提供的价值是 OpenAI 的 5 倍以上。报告对 Anthropic、OpenAI、Meta、SpaceXAI、MiniMax、月之暗面、智谱、Cursor 和 Cognition 的订阅方案做极限测试,通过隔离四类 token、记录进度条消耗,按 API 价格折算「API 等价价值」。报告发现同一厂商相同订阅中,有账号额度低约 20%,确认存在小规模额度 A/B 测试,说明厂商可随时静默调整额度。

旗舰档上,GPT-6 Astra 与 Claude Fable 5.1 额度接近,但 Fable 在 Claude 订阅中最多占总额度一半。200 美元档,Claude 用掉价值 2485 美元的 Fable 5.1 后还剩一半额度;OpenAI 消耗完价值 2897 美元的 Astra 后见底。真正拉开差距的是中档模型 Claude Opus 5.5 和 GPT-6.1 Sol,Anthropic 订阅的 API 等价价值约为 OpenAI 的 5 倍,各价位全面领先。即便改比 token 数量,差距依然很大。OpenAI 唯一反驳是 Pro 套餐无 5 小时限制,但 SemiAnalysis 认为不足以抵消 Opus 5.5 约 4 倍价值优势,并判断独立开发者过去称赞 OpenAI 额度更慷慨的说法已不成立。

差距主要来自 OpenAI 上周调整:200 美元套餐 API 等价价值被砍一半,各模型档位可用 token 减半,Sol 级因缓存输入价格下调跌幅超 50%。旧额度可保留到 10 月 29 日,新购立即适用。500 美元新档位 Astra 额度只比旧版 200 美元多 21%,Sol 级 API 等价价值不升反降,真正卖点是 300 TPS 的 Ultrafast 模式。调整后 Pro 100、200、500 每美元换到的 token 完全一致,「买大档更划算」逻辑消失。
SemiAnalysis 分析,订阅高度补贴,Anthropic 订阅约占总收入 10%,却可能吃掉 40% 以上推理算力。两家降补贴路径不同:Anthropic 渐进收缩高端模型额度;OpenAI 则一刀切将所有模型额度降到 Fable 级别。报告认为 OpenAI 因开发者日正面宣传和老用户保留旧额度而暂躲反弹,但社交媒体情绪显示可能只是推迟。
第 1 天提速是实打实改进,Tibo 辩护称模型完成任务所需 token 更少,单比 token 或 API 等价价值不能完全反映产出,SemiAnalysis 也承认 API 等价价值在模型价格极端时会失真。但「每任务省多少 token」尚无第三方量化数据,额度减半已是事实。降额前购买的 200 美元套餐旧额度 10 月 29 日到期,正落在 28 天窗口期内,届时被保护的重度用户将直接感受变化。订阅额度之争不仅是成本问题,也是用户争夺战。SemiAnalysis 提到,OpenAI 此前慷慨重置是 Codex 用户激增重要原因,Anthropic 也因此多次收回降额计划。如今情况已开始变化。
更多推荐阅读

Mistral发布1T参数大胖猫模型,激活仅49B
今天早些时候,美国开源了 glm5.2 级别的模型。随后,欧洲的 Mistral 发布了 Mistral Large 4,又名 Le Chonk 大胖猫。 该模型总参数 1.05T,每次只激活 49B,另带一个 1.6B 的视觉编码器。它采用细粒度混合专家(MoE)结构,模型拆成很多“专家”,每处理一个词只叫醒其中一小部分,因此 1T 模型每算一个词的开销接近 49B 模型。原生多模态,能读文字...
2026-10-07
xAI联创宣判:数学两千年英雄时代落幕
两千多年来,人类最聪明的大脑一直在攀登数学这片山脉。从欧几里得到怀尔斯,每征服一座山峰都要赌上一生。但xAI联合创始人Christian Szegedy认为,这个属于数学的英雄时代正在结束。 Szegedy在长文《数学何去何从?》中,将数学家比作丛林里徒手攀岩的探险家,AI则是一架飞机,已把旗插上没人爬过的山顶。孤独攀登者的时代正在结束,测绘整片大陆的时代正在开启。 Szegedy少年时在匈牙...
2026-10-06
OpenAI疯狂28天首日:模型提速50%却遭评论区翻车
Codex负责人Tibo宣布启动“疯狂28天”计划:未来28天每天要么交付一项Codex/Work改进,要么进行一次完整额度重置。第一天,Tibo宣布GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%,达到50TPS,覆盖官方订阅及Sign in with ChatGPT接入的第三方生态。 但评论区几乎无人关注提速,满屏冷嘲热讽。此前9月29日GPT-6.1 Sol上线后因负...
2026-10-06
AI研究员为何计划逃离湾区买地避难
一些Anthropic最期的员工,最近开始考虑在美国偏远地区买地。他们想过,如果AI真的失控,那里或许可以成为避难的地方。 “一切再也无法平静如初。”一些研究员的电脑上贴着同一句话。 事实上,逃离的念头并非突然出现。十多年来,一群聚集在旧金山湾区的AI安全研究人员,一直在讨论AI失控之后可能发生什么。那时候,Anthropic甚至还没有成立。 有人在伯克利设立共享办公空间,在私人Slack频...
2026-10-06
英伟达押注的Reflection开源新模型对标智谱
英伟达投资的 Reflection 发布首个开源模型 Beam,对标智谱 GLM-5.2。官方称两者在高级推理测试上分数相当,Beam 推理算力仅需后者的三分之一到四分之一。彭博和金融时报称其为美国在开源模型领域对中国的反击。但 Beam 与国内其他头部开源模型如 Qwen3.8、GLM5.3、Kimi K3、DSV4F 仍有差距。 Reflection 由谷歌 DeepMind 两位研究员 M...
2026-10-06
把35个判断交给内核:这个开源项目拿下黑客松总冠军
在进化酒馆黑客松深圳收官之战中,项目 mu(μ)获得全场冠军。它将 Jev 深度融合进 Harness,试图解决 Agent 把工具、日志、技能、上下文全部交给大模型导致效率低、Token 浪费的问题。 mu 建立在开源 Coding Agent pi 之上,主要改造模型外的 Harness,设计了 35 个判定点,覆盖用户输入、工具调用、上下文管理、任务完成判断和多 Agent 通信等环节。例...
2026-10-06