上周,OpenAI解雇了三名安全研究员——Jasmine Wang、Tomek Korbak和Mikita Balesni。公司称,他们处理机密信息的方式违反了政策。三人随后发表公开信,否认相关指控,并警告说,他们遭解雇可能会让其他员工不愿提出安全方面的担忧,也不愿与外部专家合作。
公开信说了什么
在致OpenAI安全与安保委员会及顾问团体的信中,研究员称,他们与第三方安全组织合作时遵循了现有规范。他们否认泄露了任何有关OpenAI最新模型的内部信息,包括一则关于“更难监控的架构”的报道。Wang补充说,所谓违规行为——访问一名高管的电子邮件——其实是误打开了一个委托给她的收件箱,她发现后立即报告了此事。
OpenAI的回应
OpenAI尚未公开回应这封信,但向TechCrunch分享了一份内部备忘录。备忘录肯定了三名员工的贡献,并表示解雇他们并非对其倡导安全工作的报复。备忘录称,公司“始终鼓励”员工提出担忧。不过,OpenAI没有说明具体违反了哪些政策,也没有解释如何保护与外部审计人员合作的员工。
为什么重要
如果OpenAI员工觉得自己可能因与外部安全组织交流而遭解雇,他们可能会停止报告风险,从而拖慢对危险模型行为的发现。这场争议也凸显,内部规则不明确可能影响研究人员在整个行业开展安全合作的能力。