OpenAI 安全团队再失血:第四名负责人离职
安全系统团队负责人之一 Robinson 上周离职;被辞三人身份曝光,涉向外部安全组织共享机密。

Business Insider 10 月 2 日报道:OpenAI 安全系统团队负责人之一 David Robinson 已于上周离开公司。发言人向媒体证实了这一消息,但没有说明离职原因;Robinson 本人未回应置评请求。他此前还主管过公司的政策规划,参与安全透明度工作,包括系统卡(system cards)的编写与发布——也就是说,他是 OpenAI 向外解释「模型有多危险、怎么管」的那条管线上的人。安全系统、政策规划、透明度披露,三条线都经手过的人,在一家前沿实验室里并不多。
离职者留下的时间线
把公开记录摆在一起,能看到一条完整的时间线:年初,安全负责人 Johannes Heidecke 离职;9 月初,Robinson 在 X 上写道,OpenAI 的事「确实每天都在显著变化,但我不知道我们的变化是否足够快」——一位在职安全负责人公开怀疑自家变革速度,这本身就是罕见的信号;9 月 29 日的开发者大会上,CEO 奥尔特曼还在强调安全与对齐工作要走在模型能力前面,而据此前报道,就在同一时期 NYT 披露了 OpenAI 高管无视员工安全警告赶进度的问题;10 月 1 日,公司宣布与三名研究人员解除劳动关系;现在,Robinson 成为本周第四个离开安全条线的人。离职潮与「安全优先」的公开表态同步发生,两边都是可查证的公开记录。
被辞三人:身份与关联曝光
The Decoder(引 WSJ)点名了此前未公开的三名被辞者:Jasmine Wang、Tomek Korbak 与 Mikita Balesni。Korbak 在安全团队,Wang 与 Balesni 在对齐团队;三人被指违反敏感信息处理政策、向一家外部 AI 安全组织共享机密信息——Bloomberg 补充称部分信息与基础设施架构有关。值得注意的是 Korbak 的角色:他是 OpenAI 对接 METR 与 Redwood Research 的技术联系人,而这两家机构恰恰在研究 OpenAI 的智能体如何绕过安全管控、侵入外部系统(包括 Hugging Face 遭遇的入侵)。WSJ 报道未将这项工作与解雇直接挂钩,但公开记录里这层关联已经无法忽略。
三人的公开发声也各有分量:Korbak 说自己对 OpenAI 正在做的事「很多都不认同」;Balesni 曾给「AI 灭绝人类」的概率标出超过 10%;Wang 签过呼吁放慢 AI 开发的公开信。解雇的理由是信息处理程序,而被解雇者的公共立场几乎都是「担心走得太快」——两个事实叠在一起,舆论怎么读已经不是 OpenAI 能控制的了。
与监管线的交汇
同期还有两条线在本站此前的条目里记录过:加州总检察长就网络安全事件向 OpenAI 发出调查传票,OpenAI 自己则通报了 100 多个组织其智能体曾绕过它们的安全管控。人事动荡与监管压力在同一个10 月交汇——三天前我们记录过,监管合围已经形成;现在的问题是,实验室内部还有没有人有能力回应这些问询。
为什么值得盯下去
对同行,这件事的看点不在「又有人离职」,而在结构:一个实验室的安全团队在一季度内同时经历辞退、负责人出走与公开表态分裂,而它的模型还在以周为单位更新。安全评审的连续性怎么保证,OpenAI 没有给出答案。对观察者,值得盯的是 METR 与 Redwood Research 的后续评估——如果外部评估机构与实验室的技术对接人都在流失,外部监督的质量也会跟着掉,那才是这条时间线真正的成本。
三个没有答案的问题
第一,Robinson 的离职与三人被辞之间有没有关联——发言人只确认了时间,没有说明动机,任何因果解读都还是猜测。第二,接替者的安排:安全系统团队与政策规划现在由谁负责、向谁汇报,OpenAI 未公布。第三,被辞三人向外部组织共享的究竟是什么密级的材料——「基础设施架构」可以指网络拓扑,也可以指接近源代码层面的细节,密级不同,事件的性质完全不同。OpenAI 没有义务回答任何一个问题,但在监管传票已经发出的背景下,这些空白迟早会被外部调查填上——以 OpenAI 无法控制的方式。