OpenAI解雇三名安全研究员,联名公开信曝内幕
上周,OpenAI解雇三名员工,称其违反敏感信息访问与处理规定,涉嫌在既定程序外向第三方AI安全评估组织分享机密信息。三人分别是从事模型对齐研究的Jasmine Wang、参与OpenAI与外部安全评估机构技术沟通的Tomek Korbak,以及从事AI安全及模型对齐研究的Mikita Balesni。
三人随后在社媒发表致OpenAI领导层的公开信。Mikita Balesni称,被解雇是因为“将AI安全置于OpenAI短期利益之上”。Jasmine Wang表示,解雇理由只有一个:访问了一位高管的邮箱。Tomek Korbak称,过去几个月一直担忧公司正逐渐失去监测AI Agent思维过程的能力,这才是他真正被解雇的原因,并担心OpenAI会以此为借口减少与外部审计机构METR的合作。

公开信致安全与安保委员会、安全顾问小组及使命顾问委员会。三人表示,解雇事件及其处理方式与OpenAI安全工作直接相关,内部和外部沟通已让昔日同事感到害怕,不敢再像过去那样说话和开展工作。过去员工可公开提出安全担忧、表达不同意见,公司还鼓励与独立安全机构合作,这正是OpenAI与众不同之处。
三人认为,AI不是普通技术,OpenAI也不是普通公司。从事安全研究的人往往更早发现风险,必须与外部专家密切合作。若最接近风险的研究人员无法继续与彼此及第三方建立高度信任、充分沟通的合作关系,通往超级智能的道路就不可能安全。

三人均在AI安全领域工作多年。Tomek Korbak在GPT-2时代研究强化学习实现语言模型对齐,后在Anthropic从事应用研究,加入OpenAI后研究思维链可监测性,参与撰写安全战略,分析Astra级模型思维链可监测性下降原因,并在Hugging Face事件调查中担任OpenAI与METR的技术联系人。Jasmine Wang于2019年在OpenAI政策研究团队实习,参与撰写《可信AI开发》报告,后在英国AI安全研究所领导团队,2025年重返OpenAI共同负责安全论证项目,提出“Pacing”概念,因《Pacing the Frontier》请愿书获394名OpenAI员工签名。Mikita Balesni是2023年Apollo Research创始成员之一,研究AI失对齐问题,是最早注意到AI开始意识到自己正接受评测的研究人员之一,在OpenAI从事对齐评测、失对齐科学及思维链可监测性研究,也参与Hugging Face事件调查。三人加入OpenAI前共同发起跨行业立场文件《思维链可监测性:AI安全领域一个全新而脆弱的机遇》,其中两人担任主要作者。
关于解雇,三人称始终按公司使命行事,遵循当时内部通行规范。解雇让他们担心内部工作规范正在变化,员工已不清楚哪些事可做、哪些会触碰红线。突然且公开的解雇正在对OpenAI开放文化产生寒蝉效应。若上个月还被视为正常的工作行为,这个月突然成了解雇理由,每位员工都会猜测红线在哪里。

三人澄清:并非The Information那篇涉及新型、可监测性更低模型架构报道的消息泄露者,也没有理由泄露,该报道损害了他们推进的工作。他们认为与外部机构的接触未超出职责范围。Hugging Face事件调查此前无先例,相关内部政策在调查过程中逐步制定。Tomek尽力遵守当时政策,延续公司早期与第三方合作惯例,并谨慎处理沟通。Mikita负责推动跨公司合作,争取各方就防止模型失去可监测性作出承诺,始终与董事会成员及高管协调,对外分享前仔细删除敏感信息,行动出于善意并符合当时规范。Jasmine获得某高管邮箱访问权限是因招聘工作需要且事先获授权,后权限不再需要,她主动要求撤销,但IT部门未完成移除,她本人无法撤销或退出,两个邮箱邮件合并显示且界面无明确标识。她意外点开敏感邮件后几分钟内向该高管报告,并再次请求撤销权限。
三人称有必要解释清楚,因为珍惜与同事关系,也担心传言传播,包括有关共同撰写、面向董事会的备忘录的指控。公司从未提出这项指控,他们没机会回应。他们也没有向媒体透露被解雇消息。最让他们担心的是,解雇原因至今未获清晰解释,过程公开,传言不断,已让仍在OpenAI工作的人寒心,不敢轻易发声。而此刻世界上太多与AI安全有关的事情都要依靠他们。
公开信最后提出三点建议,其中第一点是OpenAI必须兑现上个月公开承诺,让第三方安全审计机构深入参与公司内部工作,不能拿解雇当借口退出合作。继续与整个AI安全生态保持合作,对OpenAI实现使命至关重要。
更多推荐阅读

0.2秒急停!因果智能让机器人真懂物理世界
这是一台机器人正在关闭微波炉门时,因人手突然插进来而紧急悬停的时间。当金属易拉罐被混在蛋糕盘里端向微波炉,机械臂会先挑出易拉罐,确认安全后再将盘子送入炉内。即便用手电筒闪机器人的“眼睛”,它依然置若罔闻。这些画面不是动作回放,也不是碰巧猜对,而是系统基于对物理世界因果规律的理解,实时推理出的一连串动作。驱动这套机器人的系统代号为CRIS-0,背后是UCSD助理教授、CMU因果学派学者黄碧薇创立的因...
2026-10-09
字节发现DeepSeek时强时弱原因:输入位置每隔4个Token就变
字节Seed团队发现,DeepSeek-V4存在一种“神鬼二象性”:同一道题、同样的内容,仅在前面加入几个无关字符,模型答案就会在正确与错误之间反复横跳,且以4个Token为周期规律性变化。 研究人员最初用DeepSeek-V4官方推理代码中的FP8量化函数做补全测试。正确答案应为8,但模型有时会答成32。他们在代码前加入由等号组成的装饰性文档字符串,仅调整等号数量,代码、补全位置和答案均不变,...
2026-10-09
苹果10月13日发布会剧透:你家将成最大AI终端
过去十几年,苹果把越来越多设备放进用户的口袋、背包和手腕,却始终没能在客厅找到稳固位置。如今,一封写着「Welcome home」的邀请函,宣告苹果准备重新争取这个位置。苹果已官宣将于当地时间 10 月 13 日在纽约举行新品发布活动,预计推出配备屏幕的家庭中枢、新一代 HomePod mini,以及更新后的 Apple TV 4K。贯穿三款设备的核心,是屡次跳票的新一代 Siri AI。邀请函上...
2026-10-09
谢扬推出Qoni:给Agent发一张工牌
谢扬认为,Personal Agent 的终点不该是更聪明的命令行。他做的 PA infra 于国庆节后上线。同一天,ChatGPT 上线交互 UI,图形化 Personal Agent 路线之争正式开始;谢扬的 Qoni 也上线,定位为给 Agent 发工牌的基建系统。 当前 Agent 没有身份,也没有公认鉴权方法。用户只能把身份、账户信息开放给 Agent,让它假冒自己办事。类似问题互联网...
2026-10-09
谷歌Gemini 4 Argon突袭:已对部分用户开放
海外科技圈爆料,谷歌下一代模型 Gemini 4 Argon 已密集现身多个平台,并对部分 Pro 用户开放。它已登录 Google Cloud,在编程工具 Antigravity 中被设为默认模型,甚至开始在代码库直接提交代码。科技媒体 TestingCatalog 和 Benzinga 跟进证实,内部系统已上线相关发布卡片。种种迹象显示,Gemini 4 Argon 最快本周甚至数小时内突袭发...
2026-10-09
全球首款量产AI汽车巴黎首秀:从AI里“长”出来的车
2026年巴黎,AIVA品牌首款量产车AIVA ME7在巴黎时装周期间完成全球首秀。AIVA总裁、产品经理李博与时尚传媒集团品牌运营总经理沙小荔、超模雎晓雯、设计师陈鹏、商业财经博主小lin说同台,但这场首秀不聊续航和加速,而是探讨AI如何真正走进生活。 AIVA ME7的核心是“灵动光眸”。李博表示,眼睛是心灵的窗户,放在车上就应在传统大灯位置,这不是刻意设计,而是生命体相互交互的本能需要。现...
2026-10-09