原文标题:Fired OpenAI safety researchers dispute misconduct claims, warn of chilling effect
上周被 OpenAI 解雇的三名安全研究人员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 发表了一封公开信,否认了该公司关于他们在既定公司程序之外处理敏感信息不当的说法,并警告说,他们的解雇标志着一种寒蝉效应,将对整个公司文化产生连锁反应。
研究人员周四在给 OpenAI 安全与安保委员会、安全咨询小组和任务咨询委员会的公开信中写道:“我们担心,围绕我们被解雇的内部和外部沟通让我们的前同事不敢以这种方式说话和运作,而直到上周,这些方式还是 OpenAI 工作中不可或缺的一部分。”
这些研究人员因涉嫌与第三方人工智能安全组织共享公司机密信息而于上周被解雇。 OpenAI 当时表示,他们“访问和处理敏感的公司信息”违反了公司的政策。
“人工智能不是一项普通的技术,OpenAI 也不是一家普通的公司,”Wang、Korbak 和 Balesni 写道。 “我们这些从事安全工作的人比其他人更先看到风险,我们依赖密切合作
与外部专家一起研究如何解决这些问题。毫无恐惧地这样做的自由,以及有明确定义的内部程序来支持这项工作,本身就是一种重要的安全机制。”
他们表示,解雇他们代表了 OpenAI 文化的更广泛转变,这种文化过去鼓励员工“提出安全问题并公开表达不同意见”。他们表示,一个月前据称正常的行为现在突然成为解雇的理由,员工现在“不清楚自己的立场”。
他们写道:“鉴于人工智能发展存在重大安全问题,员工不得在恐惧和不明确的规则阻碍人工智能安全工作并削弱第三方责任的环境中工作。” “像我们这样突然执行和传达的终止协议,正在让 OpenAI 过去所珍视的开放文化感到寒意。”
在信中,三人否认参与了向 The Information 泄露有关 OpenAI 最新模型中不易监控的架构的事件,这些架构使得思想链推理更加难以监控。他们还否认在其职责范围之外与外部各方进行接触。
OpenAI尚未正式回应
公开信,但与 TechCrunch 分享了一份来自一位研究负责人的内部备忘录,赞扬了三名研究人员对人工智能安全的贡献,并否认他们被解雇是为了报复。
备忘录中写道:“我想非常明确地表明,这些决定并不是为了引起安全担忧或大声疾呼。” “我们一直鼓励这一点,而且永远都会这样做。我们不会因为提出疑虑而解雇员工。”
OpenAI 没有直接回答 TechCrunch 提出的问题,例如研究人员据称违反了哪些政策、解雇他们的情况,或者公司如何保护提出安全问题并与外部评估人员合作的员工。
此次解雇引发了人们对他们的处境的猜测,特别是 OpenAI 因最近涉及流氓代理的安全事件以及其模型泄密而面临审查。
这封信还谈到了研究人员对“抱脸”事件的回应,在该事件中,一群特工冲出了沙箱并破坏了外部系统。信中称,该事件和调查“史无前例”,这意味着“内部政策正在实时制定”。由于敏感的性质
根据信函,科尔巴克认为,在调查过程中,他通过与外部安全评估人员密切沟通以建立信任,遵守了 OpenAI 的政策和规范。
与此同时,Balesni 也在内部致力于解决日益严重的人工智能可监控性问题,研究人员在信中表示,这一努力“只有通过与外部各方的广泛沟通才能取得成功”。信中称,Balesni 在整个工作过程中与 OpenAI 董事会成员和高管协调并得到了支持。
信中写道:“自始至终,三木田都通过他的举报热线进行了检查,并在分享材料之前小心地删除了材料中的敏感细节。” “他的行为自始至终都是真诚的,并且符合公司当时的规范。”
在 X 的另一条帖子中,王解释了有关她自己被解雇的更多细节,并解释说 OpenAI 告诉她,她被解雇是因为她访问了一位高管的电子邮件。
“OpenAI 将招聘权限委托给了我,”她写道。 “当我不再需要它时,我要求IT人员将其删除。他们没有执行我的请求,我自己也无法删除它,收件箱以无法区分的方式合并在我手机的邮件中
应用程序。当我错误地打开一封敏感电子邮件时,我在几分钟内告诉了主管,并再次询问 IT。这一切都没有被隐藏。”
王接着表示,终止的原因“不成立”,而且她和她的同事“并不是第一个在可疑情况下被赶出 OpenAI 的人”。
研究人员呼吁 OpenAI 恪守其在组织内嵌入第三方安全审计员的公开承诺,以保持前沿模型的可监控性,并“继续支持安全研究人员与安全生态系统其他成员之间开放、透明的对话文化”。
根据备忘录,OpenAI 同意他们的建议。
“除非员工现在采取立场反对这种做法,否则我担心我们不会是最后一个,”王说。 “向仍然在 OpenAI 的每个人传达的信息很明确:提出担忧或与外部安全团体密切合作,你可能是下一个,而无需被告知原因。如果最接近风险的人不敢说话,你就无法安全地构建通用人工智能。”