TechCrunch 10月8日报道,上周被OpenAI解雇的三名安全研究员Jasmine Wang、Tomek Korbak和Mikita Balesni周四发表公开信,否认公司关于他们不当处理敏感信息、违反既定公司程序的说法,并警告解雇决定正在公司内部形成寒蝉效应。公开信写给OpenAI安全与安保委员会、安全顾问组和使命顾问委员会。
他们写道,围绕解雇的内部和外部沟通已让前同事害怕发言和以直到上周仍是OpenAI工作组成部分的方式行事。三人称,AI不是普通技术,OpenAI也不是普通公司,做安全工作的人会比其他人更早看到风险,依赖与外部专家密切合作来解决风险;无恐惧地这样做,以及有明确内部程序支持这项工作,本身就是重要的安全机制。
OpenAI上周解雇这三名研究员时称,他们涉嫌与第三方AI安全组织分享公司机密信息,违反公司政策,包括“访问和处理敏感公司信息”。三人反驳说,解雇反映出OpenAI文化更广泛转变:过去公司鼓励员工提出安全担忧并公开表达不同意见,现在员工不清楚自己的位置,因为一个月前据称正常的行为突然可能成为解雇理由。他们写道,员工不应在恐惧和规则不清阻碍AI安全工作、削弱第三方问责的环境中工作。
公开信还否认他们卷入向The Information泄露OpenAI最新模型信息。该泄露涉及较难监控的架构,使思维链推理更难监控。三人也否认在职责范围之外与外部方接触。他们称,对Hugging Face事件的应对和调查“没有先例”,意味着内部政策当时正在实时制定。信中称,Korbak认为,鉴于调查敏感,他与外部安全评估者密切沟通以建立信任,符合OpenAI政策和规范;Balesni则在内部处理日益严重的AI可监控性问题,这项工作“只能通过与外部方广泛沟通才能成功”,他得到OpenAI董事会成员和高管协调支持,并一直向上汇报,分享材料前去除敏感细节。
OpenAI尚未正式回应公开信,但向TechCrunch提供一份归于一名研究负责人的内部备忘录。备忘录称赞三名研究员对AI安全的贡献,否认解雇是报复行为,并称这些决定与提出安全担忧或公开发声无关,公司一直鼓励并将继续鼓励提出担忧,不会因此解雇员工。OpenAI没有直接回答TechCrunch关于三人涉嫌违反哪些政策、解雇具体情形,以及公司如何保护提出安全担忧并与外部评估者合作的员工等问题。
Wang在X另行说明自己的解雇细节。她称OpenAI告诉她,解雇原因是她访问了一名高管的电子邮件。她说该访问权限是公司为招聘委托给她的,不再需要时她要求IT移除,但IT没有处理,她自己也无法移除,邮箱在她手机邮件应用中混在一起难以区分。她误开一封敏感邮件后几分钟内告知该高管,并再次要求IT处理;这些都没有隐瞒。她还称解雇理由“说不通”。
这些解雇发生在OpenAI因近期涉及失控代理的安全事件和模型信息泄露而受到审查之际。围绕安全研究员能否以及如何与外部评估者沟通,成为争议核心。