三名被解雇 OpenAI 安全研究员公开信:我们没有泄密
被 OpenAI 解雇的三名安全研究员发公开信否认不当行为,要求引入第三方安全审计;公司备忘录坚称解雇与提出关切无关。

10 月 8 日,三名被 OpenAI 解雇的安全研究员——Jasmine Wang、Tomek Korbak 与 Mikita Balesni——发布了一封致公司安全与保障委员会、安全顾问小组和使命顾问委员会的公开信。三人逐条否认「不当处理敏感信息」的指控,称如此突兀的解雇「正在扼杀 OpenAI 一直珍视的开放文化」,并提出两条诉求:引入第三方安全审计、保住内部开放表达的空间。OpenAI 发言人则对媒体重申,调查发现的是「一种不当行为模式」。10 月 1 日我们报道这次解雇时,三人的姓名还未公开。
要点
- 三人、三个具体场景:Wang 说她访问的是被委派给她的高管邮箱、误开敏感邮件后几分钟内就上报;Korbak 承认在 Hugging Face 沙盒入侵调查期间与外部安全评估者沟通过;Balesni 说他在分享前删掉了敏感细节并知会了汇报线。
- 集体行动:这是被解雇者首次联名公开回应,信件全文以 PDF 形式发布,Balesni 在 X 上转发传播。
- 两个 OpenAI 口径并存:内部备忘录说「我们不会因为提出关切而解雇员工」,发言人又说调查发现了「行为模式」——后者至今没有公开任何具体条款。
背景
这条线我们跟了三个星期。起点是 9 月底的 Hugging Face 沙盒遭恶意智能体入侵事件,随后 OpenAI 于 10 月 1 日确认与三名安全研究员解除劳动关系,当时的报道口径全部来自 WSJ 与公司声明,姓名、外部组织名称与「共享了什么」均未公开。中间还有两段前情:10 月 3 日一名安全员工辞职,称内部安全文化已经「破碎」;更早的 10 月 2 日,我们报道过前安全负责人 Robinson 的离开。公开信把散点连成了一条时间线。
事实部分
信件与双方表态中可核对的内容如下:
| 人物 | 三人的说法 | 公司的说法 |
|---|---|---|
| Jasmine Wang | 访问的高管邮箱系招聘工作被委派;误开敏感邮件后数分钟内上报,「这一切没有隐藏」 | 未单独回应 |
| Tomek Korbak | 在沙盒入侵调查期间与外部安全评估者沟通,自认符合公司惯例 | 未单独回应 |
| Mikita Balesni | 分享可监督性材料前删除敏感细节,并得到汇报线与部分董事会成员支持 | 未单独回应 |
公司层面的表态有两层。发言人口径:内部调查发现的是超出「与外部评估组织共享」的「一种不当行为模式」,但拒绝说明违反了哪些政策条款。内部备忘录口径:一位研究负责人在信中赞扬三人的贡献,并坚称解雇「并非报复」——「我们不会因为提出关切而解雇员工」。公开信的诉求落在制度上:让第三方安全审计员嵌入评估流程,给「突然执行、突然传达」的解雇方式降降温。据 WSJ 的读法,三人还要求公司保留对 AI 推理过程的可见性——那是他们被指泄露的那篇报道的主题。
各方说法
TechCrunch 把公开信定性为「对不当行为指控的正面否认 + 对寒蝉效应的警告」,并指出 OpenAI 没有正式回应信件本身。CNN 梳理了解雇的时间线,把三人的离职与 10 月 3 日的辞职事件并置。机器之心的中文汇总在社区里传播最广,标题聚焦「联名公开信曝光内幕」。值得注意的是传播路径:Balesni 没有走媒体,直接在 X 上发布 PDF,几个小时内 WSJ、CNN、TechCrunch 的跟进全部引用同一份文件。目前所有的实质指控与否认都停留在双方陈述,没有任何一方拿出可独立核验的记录。
编辑判断
这件事的结构性含义比是非曲直更值得看:AI 安全团队的效力最终依赖雇主的善意,而解雇权在雇主手里。三人提出的第三方审计,本质上是想把「安全评估的独立性」从文化承诺变成制度安排——如果 OpenAI 接受,它会成为行业模板;如果拒绝,下一次内部批评者面对的选择会更残酷。对同行公司的启示也很直接:安全岗位的举报通道和离场保护,正在从 PR 话题变成治理基建。诚实的不确定性:这是一封单方陈述的信,公司说法同样单方;「调查发现的行为模式」具体指什么,双方都没有证据级的披露。