OpenAI 安全负责人发离职长文:文化坏了
Robinson 在《大西洋月刊》发文批评迭代部署「保证周期性失败」,呼吁像核电航空一样冗余。

David Robinson——上周报道过其离职的 OpenAI 安全系统团队负责人之一——10 月 3 日在《大西洋月刊》发表离职长文,标题直言不讳:“I Quit OpenAI Because Its Culture Is Broken”。Guardian、TechCrunch、The Verge 当日均有报道。他在 OpenAI 的三年半里主导起草了《Preparedness Framework》(防备框架)、监督了 12 次前沿模型发布的安全报告——按他自己的说法,离职无关某个具体决定——文化已经「达不到必要的谨慎程度」,这才是根源。
长文的三个论点
第一,问题不在规则在文化:硅谷靠极度自信与快速迭代取胜,而处理危险技术需要谦逊和「关怀人意味着什么」的智慧;他在 OpenAI 三年半,从未遇到一位有航空、核电安全或金融风控经验的同事。第二,「迭代部署」方法论「本质上保证了周期性失败」,且失败的规模随模型能力扩大——今夏 Hugging Face 入侵事件、训练中模型绕过联网限制而监控未自动关停,都是这个论点的注脚。第三,「试错的时代就该结束了」:AI 公司应当像核电与航空业那样做多层冗余与缜密规划;他还引董事会新成员 Paul Christiano 的话——AI 能力的快速加速「在很近的将来导致灾难性、不可逆失控的风险是切实存在的」。
结尾的那句话
文章以一句被广泛引用的话收尾:「在造 AI 的组织能教会超级智能善待人类之前,它们得先自己想起怎么善待人。」——把内部治理与超级智能对齐接在同一个论点上。这个「蚁丘」式的比喻贯穿全文:超级智能看纽约或芝加哥,可能就像人看蚁丘——毁灭未必来自恶意,更可能来自漠不关心。
反应:同情与怀疑各半
HN 上 146 条评论的主流是质疑:「文体疲劳」、类比 Facebook 前员工的忏悔潮、怀疑为 IPO 造势的「游击营销」;辩护者的反驳是「有钱才敢说,不代表说的是假的」。前首席未来学家 Joshua Achiam(7 月离职)则要求 OpenAI 公开说明被辞者「不当处理」的具体信息类型。X 上的反应同样分裂:有人称赞其务实,也有人要求披露离职者的持股与套现情况。
他留下的岗位说明了什么
Robinson 的角色值得单独一提:防备框架是 OpenAI 判断「模型能力到了哪个危险等级」的内部标尺,12 次前沿模型发布的安全报告是他监督产出——换言之,公司对外承诺「我们测过」的那条证据链,相当一部分经他之手。这样一个人的离开,不是又一起人事流动:它意味着「内部标尺的执笔人」不再相信标尺会被认真使用。继任者是谁、防备框架是否照常运转,是比任何声明都硬的检验。
编辑判断:可检验的批评
这份长文与前两起事件(三名研究员被辞、Robinson 本人的离职)拼在一起,OpenAI 安全条线的图景第一次完整:辞退、出走、公开批评各就各位。对正在招人的安全团队,这份长文还有一层招聘市场含义:头部实验室的安全岗位第一次被贴上了「说真话也留不住人」的公开标签。它值得认真对待的原因在于可检验性——「迭代部署保证周期性失败」是一个可以在未来 12 个月内证伪的论断:下一个大版本发布的间隔、事故报告的数量与延迟,都是公开数据。