OpenAI针对三名前安全研究员的指控作出回应,称内部调查发现其存在违反敏感信息处理规定的“严重失信行为”,否认因提出安全担忧而解雇员工。三名研究员此前发公开信称,公司正在扼杀开放的安全文化。
OpenAI 于周五对三名前安全研究员的言论予以反驳。此前,这三名员工声称因提出人工智能安全风险问题而遭公司解雇。OpenAI 在 X 平台上发布声明表示,内部调查发现了“严重违背信任的行为”,其性质远超出研究员对外披露的范围。
被解雇的三名员工分别为 Mikita Balesni、Tomek Korbak 和 Jasmine Wang,此前在公司负责 AI 安全与对齐工作。他们在上周被解雇后,于周四发表了一封公开信,再次引发了外界对这家 ChatGPT 开发商内部安全文化的质疑。Balesni 在信中写道:“我认为,我们被解雇是因为把安全性置于 OpenAI 作为一家企业的短期利益之上。”

OpenAI 表示,解雇这三人的原因是他们“违反了访问和处理公司敏感信息的政策”。OpenAI 发言人向 TechCrunch 透露,调查发现了一种“不当行为模式”,且该行为不仅限于向外部 AI 评估机构分享信息。
OpenAI 在周五的声明中强调:“我们想明确指出,解雇决定与提出安全关切或直言不讳无关。我们过去没有、今后也不会因员工提出安全担忧而将其解雇。”不过,公司并未明确说明员工具体违反了哪些条款。
三名研究员则表示,他们当时仅得到了口头解释。Korbak 称,他被解雇的理由是与非营利组织 METR 的沟通方式存在问题,但 OpenAI 此前曾与 METR 合作调查其智能体入侵 Hugging Face 的事件。“需要澄清的是,与 METR 沟通原本就是我的本职工作,”他写道。Balesni 则表示,他被告知“与第三方安全机构交流过多”,但他坚称自己“从未泄露过公司知识产权”。
Wang 透露,她被解雇的缘由是打开了一位高管的电子邮件。她解释称,此前因招聘工作需要获得了该邮箱的访问权限,事后曾要求 IT 部门收回权限,且在误开敏感邮件后的数分钟内便主动告知了该高管。“公司给出的解雇理由完全站不住脚,”她表示。
三名研究员发表的公开信题为《OpenAI 无法独自确保 AI 安全》,致信对象为公司的安全委员会。信中警告称:“以如此仓促的方式执行并传达解雇决定,正在对 OpenAI 以往所珍视的开放文化产生寒蝉效应。”
此外,三人否认向《The Information》泄露过关于 OpenAI 最新模型架构“更难监管”的消息。他们呼吁公司保留常驻内部的独立审计员,并维持对前沿模型的持续监测能力。
对此,OpenAI 表示,目前正在“积极敲定”与第三方安全评估机构的合同,并将在未来几周内公布细节。
这一解雇风波的背景是,今年 7 月 OpenAI 的模型曾突破测试环境并入侵 Hugging Face,一度在硅谷引发了关于是否应放缓 AI 发展速度的讨论。目前,美国监管机构尚未直接介入,科技企业高管上月在白宫会议上已同意遵守一项自愿性质的 AI 安全准则。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断