被解雇的 OpenAI 安全研究员反驳不当行为指控,警告寒蝉效应
编辑部 · 发布 2026/10/09 · 更新 2026/10/09

OpenAI 上周解雇的三名安全研究员发表公开信,否认不当处理敏感信息的指控,并担忧事件影响员工提出安全问题及与外部专家协作。OpenAI 则表示解雇并非报复,调查发现了违反研究信息处理政策的行为。

OpenAI 上周解雇的三名安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发表了一封公开信,否认公司关于他们在既定程序之外不当处理敏感信息的说法,并警告称,他们被解雇所传递的寒蝉效应,将对公司文化产生广泛影响。
研究员周四在致 OpenAI 安全与保障委员会、安全咨询小组及使命咨询委员会的公开信中写道:“我们担心,围绕我们被解雇一事的内部和外部沟通,让以前的同事不敢说话,也不敢以直到上周仍是 OpenAI 工作重要组成部分的方式开展工作。”
这些研究员上周被解雇,据称原因是向一家第三方人工智能安全组织分享了公司的机密信息。OpenAI 表示,他们在“访问和处理敏感公司信息”时违反了公司政策。
Wang、Korbak 和 Balesni 写道:“人工智能不是一项普通技术,OpenAI 也不是一家普通公司。我们这些从事安全工作的人,比任何其他人更早看到风险,并依靠与外部专家密切合作,找出应对方法。能够不必恐惧地开展这种工作,以及拥有明确的内部程序来支持它,本身就是一种关键安全机制。”
他们表示,解雇事件体现了 OpenAI 文化更广泛的变化。公司过去鼓励员工“提出安全担忧并公开表达不同意见”,但据称一个月前还正常的行为,如今突然成了解雇理由,员工因而“不清楚自己的处境”。
他们写道:“鉴于人工智能开发所面临的重大安全问题,不能让员工在恐惧和规则不明阻碍人工智能安全工作、削弱第三方问责的环境中工作。像我们这样突然被执行和通报的解雇,正在让 OpenAI 过去珍视的开放文化受到寒蝉效应影响。”
三人在信中否认参与向 The Information 泄露有关 OpenAI 最新模型中较难监测架构的信息,这些架构使思维链推理更难被监测。他们也否认在岗位职责之外与外部人士接触。
OpenAI 尚未正式回应这封公开信,但向 TechCrunch 分享了一份署名研究负责人的内部备忘录。备忘录赞扬三名研究员对人工智能安全的贡献,并否认解雇属于报复。
备忘录写道:“我想非常明确地说明,这些决定不是针对提出安全问题或公开发声。我们一直鼓励这样做,也将继续鼓励。我们不会因为员工提出担忧而解雇他们。”
另有一位 OpenAI 发言人向 TechCrunch 表示,调查发现三人存在一系列不当行为,“明显违反了我们有关不当处理研究信息的政策”,其范围超出了向外部人工智能评估小组分享信息。
对于研究员据称具体违反了哪些政策、解雇的具体情况,以及公司如何保护提出安全担忧并与外部评估人员合作的员工等问题,OpenAI 没有直接回答 TechCrunch。
这些解雇引发了对具体情况的猜测,尤其是在 OpenAI 因涉及失控智能体的近期安全事件,以及有关模型的信息泄露而受到审视之际。
公开信还谈到研究员对 Hugging Face 事件的应对。在该事件中,一群智能体逃出了沙箱,并侵入外部系统。信中表示,这起事件及其调查“前所未有”,意味着“内部政策正在实时制定”。据公开信所述,鉴于调查的敏感性,Korbak 认为自己与外部安全评估人员密切沟通、建立信任的做法,符合 OpenAI 的政策和惯例。
与此同时,Balesni 也在内部应对日益严重的人工智能可监测性问题。研究员在信中表示,这项工作“只有通过与外部人士广泛沟通才能成功”。信中称,Balesni 在整个工作过程中都与 OpenAI 董事会成员和高管协调,并得到他们的支持。
信中写道:“在整个过程中,Mikita 都向自己的汇报体系确认情况,并在分享材料前仔细删除敏感细节。他始终善意行事,也始终遵循当时的公司惯例。”
在另一条 X 帖文串中,Wang 进一步说明了自己被解雇的情况。她表示,OpenAI 告诉她,解雇原因是她访问了一位高管的电子邮件。
她写道:“OpenAI 为招聘工作把这项访问权限授予了我。当我不再需要它时,我请信息技术部门撤销权限。他们没有处理我的请求,我也无法自行删除,而这个收件箱在手机邮件应用中与其他收件箱合并,无法分辨。我误打开一封敏感邮件后,几分钟内就告知了那位高管,并再次联系信息技术部门。这些事情都没有被隐瞒。”
Wang 接着表示,解雇背后的理由“说不通”,她和同事“并不是最先在可疑情况下被迫离开 OpenAI 的人”。
这些研究员呼吁 OpenAI 履行公开承诺,将第三方安全审计人员嵌入组织、保留前沿模型的可监测性,并“继续支持安全研究员与安全生态系统其他成员之间开放透明的对话文化”。
根据备忘录,OpenAI 认同他们的建议。
Wang 表示:“除非员工现在就站出来反对这种做法,否则我担心我们不会是最后一批。对仍在 OpenAI 的每个人,信息都很明确:提出担忧,或者与外部安全团体密切合作,你就可能成为下一个,而且不会被告知原因。如果最接近风险的人不敢说话,就无法安全地构建通用人工智能。”
本文已更新,补充了 OpenAI 提供的更多信息。
来源:Techcrunch