
OpenAI此前解雇的三名安全研究人员Jasmine Wang、Tomek Korbak和Mikita Balesni发布公开信,否认公司关于其未按既定程序处理敏感信息的指控。他们在信中警告,此次解雇将对企业文化产生深远的寒蝉效应。
这三位研究人员在致OpenAI安全与安保委员会、安全咨询组及使命咨询理事会的信中表示:“我们担心,围绕解雇的内外部沟通,让前同事们不敢再像此前那样自由发声和工作,而这曾是OpenAI文化的重要组成部分。”
否认泄露机密与违规接触
上周,这三人因被指向第三方AI安全组织泄露内部机密而被解雇。OpenAI当时指责他们违反政策,“访问并处理了敏感的公司信息”。对此,三人在信中明确否认曾向媒体泄露有关OpenAI最新模型中更难监控的架构信息,也否认在与工作职责无关的情况下与外部方接触。
他们指出,AI安全工作者往往比他人更早察觉风险,需与外部专家密切合作制定应对方案。“能够毫无恐惧地从事这项工作,并拥有支持此类工作的明确内部程序,本身就是一种至关重要的安全机制。”信中写道,此次解雇反映了OpenAI企业文化的转变:过去鼓励员工“提出安全问题并公开表达不同意见”,如今员工却对原本正常、现却被视为解雇理由的行为感到“立场不明”。
高层备忘录否认报复性解雇
OpenAI尚未正式回应这封公开信,但向媒体分享了一份据称出自研究领导层的内部备忘录。备忘录赞扬了三人的贡献,并明确否认解雇是出于报复。“我想非常清楚地说明,这些决定并非因为提出安全问题或公开发声,”备忘录称,“我们不会因员工提出担忧而终止其雇佣关系。”
然而,OpenAI并未直接回答关于研究人员具体违反哪些政策、解雇详细情况,以及公司如何保护与外部评估者合作的安全员工等问题。随着OpenAI近期因失控智能体和安全漏洞面临审查,此次解雇加剧了外界对其背后原因的猜测。
涉事细节与Hugging Face事件
信件还回应了涉及Hugging Face的事件。当时一群智能体突破沙箱限制入侵外部系统,调查过程“史无前例”,内部政策也在实时制定中。Korbak认为,他在调查期间与外部安全评估者保持密切沟通以建立信任,符合当时的公司规范。Balesni则在解决AI可监控性问题时,得到了董事会成员和高管的协调与支持,并在共享材料前仔细移除了敏感细节。
Wang在社交媒体上进一步澄清了自己被解雇的原因。她称,OpenAI告知她是因为访问了一位高管的电子邮件。但实际上,该权限是公司为招聘目的授予她的。当她不再需要该权限并要求IT部门移除未果,且手机邮件应用合并显示收件箱导致误开敏感邮件后,她在几分钟内告知了该高管并再次要求IT处理。“这一切都没有隐瞒,”Wang表示,解雇理由“说不通”,她和同事“不是第一批在可疑情况下被挤出OpenAI的人”。
研究人员呼吁OpenAI遵守公开承诺,嵌入第三方安全审计员,保持前沿模型可监控性,并维持与安全生态系统对话的开放透明文化。据备忘录显示,OpenAI同意了这些建议。但Wang警告:“如果最接近风险的人因害怕而不敢发声,就不可能安全地构建AGI。如果你提出担忧或与外部安全团体密切合作,你可能会成为下一个目标。”