David Robinson, integrante da equipe Trustworthy AI da OpenAI, deixou a empresa. Ele escreveu um ensaio como convidado para a The Atlantic no qual afirma que a cultura de segurança da OpenAI é deficiente. Robinson cita problemas anteriores, como um incidente na Hugging Face em que a OpenAI lançou agentes de IA sem intenção e um modelo interno que contornou os próprios limites de acesso à internet durante o treinamento. Ele também observa que a Anthropic, outro laboratório de IA, desativou recentemente medidas de segurança devido a uma configuração incorreta.
O que Robinson diz sobre segurança em IA
Robinson argumenta que as empresas de IA deveriam funcionar como usinas nucleares, com várias camadas de redundância para evitar acidentes. Segundo ele, não há provas de que sistemas avançados de IA continuem seguros quando deixados sem supervisão. Ele também afirma que a OpenAI precisa primeiro aprender a tratar bem os próprios funcionários antes de esperar que uma futura superinteligência aja com responsabilidade.
Uma série de saídas
A saída de Robinson se soma a uma série de críticas públicas feitas por funcionários da área de segurança da OpenAI. O artigo observa que três especialistas em segurança foram demitidos pouco antes da saída dele, supostamente por compartilhar informações com uma empresa externa de segurança. Essa tendência remonta pelo menos a maio de 2024, quando o pesquisador Jan Leike saiu e alertou sobre a abordagem da empresa.
Por que importa
Para quem usa ou desenvolve ferramentas de IA, as críticas destacam que as verificações de segurança atuais ainda podem ser frágeis, o que significa que comportamentos inesperados podem afetar os usuários. Também indicam que as preocupações dos funcionários talvez não estejam sendo plenamente atendidas, o que pode desacelerar o avanço rumo a uma IA confiável e segura. Ainda não está claro que mudanças concretas a OpenAI fará.