OpenAIは先週、安全性研究者のJasmine Wang、Tomek Korbak、Mikita Balesniの3人を解雇した。同社は、機密情報の取り扱いに関する方針に違反したとしている。3人は公開書簡でこの आरोपを否定し、解雇によってほかの社員が安全性への懸念を伝えたり、外部の専門家と協力したりすることをためらうようになる恐れがあると警告した。
書簡の内容
OpenAIの安全・セキュリティ委員会と諮問グループに宛てた書簡で、研究者らは外部の安全性団体との協力にあたり、既存の慣行に沿って行動したと主張している。OpenAIの最新モデルに関する「監視しにくいアーキテクチャー」の話を含め、社内情報を漏らしたことはないと否定した。Wangは、役員のメールにアクセスしたとされる問題について、委任された受信トレイを誤って開いただけで、すぐに報告したと説明している。
OpenAIの対応
OpenAIは書簡に対して公には回答していないが、TechCrunchに社内メモを提供した。メモは3人の貢献を称賛し、解雇は安全性をめぐる提言への報復ではないとしている。また、同社は懸念を伝えることを「常に奨励している」と記している。一方で、具体的にどの方針に違反したのか、外部監査人と連携する社員をどう保護しているのかについては明らかにしなかった。
なぜ重要か
OpenAIの社員が外部の安全性団体と話すことで解雇されるかもしれないと感じれば、リスクの報告をやめ、危険なモデルの挙動の発見が遅れる可能性がある。この対立は、社内ルールの不明確さが、業界全体で研究者が安全性に関する協力を進めるうえでどう影響するかも浮き彫りにしている。