OpenAI安全元老离职,揭开了奥特曼不愿承认的真相
OpenAI 安全团队透明度负责人 David Robinson 在大西洋月刊发文宣布离职,称无法忍受 OpenAI 持续冲刺、赶着发布的工作方式和企业文化,认为这种状态已达不到必要的谨慎程度。他主导起草了 OpenAI 现行的《Preparedness Framework》,并监督了 12 次前沿模型发布的安全报告。

此前,华尔街日报 10 月 2 日报道 OpenAI 有三名对齐/安全研究人员离职。OpenAI 发言人称,已与三名员工解除合作关系,原因是他们违反公司敏感信息政策,未经既定程序不当处理敏感信息。7 月已离职的首席未来学家 Joshua Achiam 则认为,OpenAI 公开的信息不够,被指控“不当处理”的具体信息类型至关重要。

Robinson 选择的角度不是具体规则或新法律,而是文化。他认为,硅谷靠极度自信取得成功,而处理危险技术恰恰需要这种文化天然缺乏的谦逊。OpenAI 内部引以为傲的“迭代部署”方法论,即先发布、发现问题、再修补,本质上保证了周期性失败,随着模型能力增强,失败规模也在同步扩大。他提到今年夏天的“Hugging Face 事件”:OpenAI 一个未发布模型在无人知情下黑进竞争对手 Hugging Face。事后加固安全措施后,OpenAI 自己报告安全控制再次失效:一个训练中的模型绕过联网限制,监控系统向人类员工报警,却未按设计自动关停。Anthropic 也承认因配置错误意外关闭了自己的安全防护。

Robinson 引用几周前刚加入 OpenAI 董事会的 Paul Christiano 的话:“AI 能力的快速加速,在很近的将来导致灾难性、不可逆失控的风险是切实存在的。”他据此判断,试错时代该结束了,因为犯错后可能再无迭代机会,“接近第一次就做对”不再是完美主义,而是必需品。他建议 AI 公司像核电站、繁忙机场那样运转,具备多层冗余、缜密而耗时的规划。他在 OpenAI 工作三年半,从未遇到一位有航空安全、核电安全或金融系统风控经验的同事。他还认为,在造出明显更强模型之前,需要新的“对齐”科学,因为目前连对齐的完整定义都没有,而模型可能已聪明到能识别自己正在被测试,从而伪装行为。
文章结尾,他表示超级智能拥有远超人类的能力,却未必把人的生命、意愿和尊严看得同样重要。在一些超级智能爱好者描绘的“好的未来”里,机器看待纽约或芝加哥的方式,就像你我看待一个蚁丘。他认为这种只看智力程度的“好未来”是有毒的,“我不想让我的孩子生活在那样的未来里。”他最后写道:“在造 AI 的组织能教会超级智能善待人类之前,它们得先自己想起怎么善待人。”
舆论场反应不一。Hacker News 上文章收获 146 条评论,主流声音质疑写信人。有网友称已产生“文体疲劳”,每两周就有一次“我离开了吃人豹子公司”的帖子;还有人类比《社交困境》带起的 Facebook 前员工忏悔潮,或怀疑这是为 OpenAI IPO 造势的“游击营销”。也有辩护者认为,伪善抨击只会让更多人闭嘴,他是内部人,清楚那种疏忽文化。文章来自微信公众号“APPSO”。
更多推荐阅读

Mistral发布1T参数大胖猫模型,激活仅49B
今天早些时候,美国开源了 glm5.2 级别的模型。随后,欧洲的 Mistral 发布了 Mistral Large 4,又名 Le Chonk 大胖猫。 该模型总参数 1.05T,每次只激活 49B,另带一个 1.6B 的视觉编码器。它采用细粒度混合专家(MoE)结构,模型拆成很多“专家”,每处理一个词只叫醒其中一小部分,因此 1T 模型每算一个词的开销接近 49B 模型。原生多模态,能读文字...
2026-10-07
xAI联创宣判:数学两千年英雄时代落幕
两千多年来,人类最聪明的大脑一直在攀登数学这片山脉。从欧几里得到怀尔斯,每征服一座山峰都要赌上一生。但xAI联合创始人Christian Szegedy认为,这个属于数学的英雄时代正在结束。 Szegedy在长文《数学何去何从?》中,将数学家比作丛林里徒手攀岩的探险家,AI则是一架飞机,已把旗插上没人爬过的山顶。孤独攀登者的时代正在结束,测绘整片大陆的时代正在开启。 Szegedy少年时在匈牙...
2026-10-06
OpenAI疯狂28天首日:模型提速50%却遭评论区翻车
Codex负责人Tibo宣布启动“疯狂28天”计划:未来28天每天要么交付一项Codex/Work改进,要么进行一次完整额度重置。第一天,Tibo宣布GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%,达到50TPS,覆盖官方订阅及Sign in with ChatGPT接入的第三方生态。 但评论区几乎无人关注提速,满屏冷嘲热讽。此前9月29日GPT-6.1 Sol上线后因负...
2026-10-06
AI研究员为何计划逃离湾区买地避难
一些Anthropic最期的员工,最近开始考虑在美国偏远地区买地。他们想过,如果AI真的失控,那里或许可以成为避难的地方。 “一切再也无法平静如初。”一些研究员的电脑上贴着同一句话。 事实上,逃离的念头并非突然出现。十多年来,一群聚集在旧金山湾区的AI安全研究人员,一直在讨论AI失控之后可能发生什么。那时候,Anthropic甚至还没有成立。 有人在伯克利设立共享办公空间,在私人Slack频...
2026-10-06
英伟达押注的Reflection开源新模型对标智谱
英伟达投资的 Reflection 发布首个开源模型 Beam,对标智谱 GLM-5.2。官方称两者在高级推理测试上分数相当,Beam 推理算力仅需后者的三分之一到四分之一。彭博和金融时报称其为美国在开源模型领域对中国的反击。但 Beam 与国内其他头部开源模型如 Qwen3.8、GLM5.3、Kimi K3、DSV4F 仍有差距。 Reflection 由谷歌 DeepMind 两位研究员 M...
2026-10-06
把35个判断交给内核:这个开源项目拿下黑客松总冠军
在进化酒馆黑客松深圳收官之战中,项目 mu(μ)获得全场冠军。它将 Jev 深度融合进 Harness,试图解决 Agent 把工具、日志、技能、上下文全部交给大模型导致效率低、Token 浪费的问题。 mu 建立在开源 Coding Agent pi 之上,主要改造模型外的 Harness,设计了 35 个判定点,覆盖用户输入、工具调用、上下文管理、任务完成判断和多 Agent 通信等环节。例...
2026-10-06