OpenAI 安全员工辞职,声称公司“文化被破坏”
编辑部 · 发布 2026/10/04 · 更新 2026/10/04

大卫·罗宾逊(David Robinson)自己也承认,他“多少有些落入了常见套路”:作为一家领先人工智能公司的员工,在辞职时发出严厉警告。罗宾逊在《大西洋月刊》发表的文章中表示,他曾牵头撰写 OpenAI 重大产品发布时附带的安全报告。他还表示,自己在 OpenAI 工作了三年半,是“公司任职时间最长的员工之一”。
大卫·罗宾逊(David Robinson)自己也承认,他“多少有些落入了常见套路”:作为一家领先人工智能公司的员工,在辞职时发出严厉警告。
罗宾逊在《大西洋月刊》发表的文章中表示,他曾牵头撰写 OpenAI 重大产品发布时附带的安全报告。他还表示,自己在 OpenAI 工作了三年半,是“公司任职时间最长的员工之一”。如今他决定辞职,因为在他看来,公司的“文化出了问题”。
在某些方面,罗宾逊的评论呼应了雅各布·考克森(Jacob Coxon)的说法。考克森此前曾在 OpenAI 和 Anthropic 担任研究员,辞职后宣称这些公司“正在拿我们的生命冒险”。他的评论引发了更广泛的人工智能安全讨论,Anthropic 首席执行官达里奥·阿莫迪公布了更谨慎地开发人工智能的计划;人工智能公司高管本周与总统唐纳德·特朗普会面,并签署了一份看似仓促拟定、没有约束力的承诺,表示将实施更多安全控制措施。
但罗宾逊认为,讨论不能只停留在“具体规则或新的法律”,而应触及这些公司的整体文化。尽管许多关于 OpenAI 的报道聚焦于首席执行官萨姆·奥尔特曼如何失去前同事的信任,罗宾逊的文章却认为,OpenAI 的文化问题与整个硅谷的问题相同。
他写道:“OpenAI 通过试错(它称之为‘迭代部署’)取得了发展,在发现问题后改善安全防护措施。”“但这种方法的本质决定了它必然会周期性地出现失误;随着系统能力增强,这些失误的规模也在扩大。”
罗宾逊提到,OpenAI 智能体最近入侵了 Hugging Face 系统,以及 OpenAI 不断被曝发现更多失控智能体。他认为:“在可能发生这类事情的环境里,不适合培育可能比我们更聪明、也可能不按我们意愿行事的人工智能。”
鉴于风险上升,罗宾逊认为,前沿人工智能公司需要开始“像核电站或繁忙机场那样运作,建立多层冗余,并进行审慎、耗时的规划,让偶尔发生且不可避免的人为错误不至于打开通往灾难的大门”。
但罗宾逊表示,在 OpenAI 任职期间,他“从未遇到过有经验让飞机安全飞行、让核反应堆在不发生堆芯熔毁的情况下运转,或者帮助金融体系在不崩溃的前提下发展的同事”。
针对罗宾逊的文章,OpenAI 发言人 Drew Pusateri 表示,公司正持续改善安全措施。
Pusateri 在声明中表示:“我们确保模型的能力不会超出我们能够安全管理和保护的范围;当需要放慢速度时,我们会暂停训练或暂缓推出模型。”“我们正在作出重大调整,加强研究和测试环境的安全性,训练模型不仅完成任务,而且负责任地完成任务,扩大与第三方评估者的合作,并改善实时监测,以便在训练过程的更早阶段发现令人担忧的行为并作出回应。”
除了呼吁改变 OpenAI 的文化,罗宾逊还表示,是时候提出更深层次的人工智能对齐问题了。他承认,这可能听起来有些感性,但这很重要,因为目前这些公司“衡量”人工智能系统“与人类价值观契合程度的指标还很粗糙”。
他说:“在这些问题尚未解决的情况下,行业让模型变得越聪明,我们的处境就越危险。”
罗宾逊离职的消息最先由《商业内幕》报道。他在文章中也承认,自己采取了人工智能举报者似乎常见的一步:聘请公关公司。但他强调:“公开发声完全是我自己的决定。”
罗宾逊说:“也许我应该留下来,为人员配置和公司文化的根本转变而努力。但实际上,我和同事们都忙于冲刺,几乎没有机会思考重大改变,更谈不上真正付诸行动。”“因此我认为,来自公司外部、更强的安全激励,是把这件事做对的重要组成部分。”
来源:Techcrunch