A OpenAI está lançando uma marca-d’água invisível chamada textGrain para os textos gerados pelo ChatGPT e pelo Codex. O recurso ficará ativo para usuários da União Europeia. A empresa diz que a função será ativada nas próximas semanas para atender à exigência da Lei de IA da UE de que textos gerados possam ser identificados por máquinas. Desenvolvedores que usam a API da OpenAI poderão ativar ou desativar a marca-d’água quando quiserem — uma abordagem diferente da adotada pela Anthropic, que impõe a marca-d’água a todas as respostas do Claude no mundo todo.
Como a marca-d’água funciona e quais são seus limites
A textGrain insere um padrão estatístico na escolha de palavras do modelo, de forma semelhante ao SynthID, do Google, usado no Claude da Anthropic. Nos testes internos da OpenAI, o detector identifica o padrão em cerca de 95% de trechos de psicologia com 400 tokens (aproximadamente 300 palavras), mas em apenas cerca de 60% de trechos de matemática com o mesmo tamanho. Alterar até mesmo uma pequena parte do texto reduz a detecção: substituir 10% das palavras por sinônimos derruba a taxa de identificação de aproximadamente 92% para 66%; trocar um quarto das palavras a reduz para cerca de 17%.
Acesso ao detector
Por enquanto, a OpenAI dará acesso ao detector apenas a pesquisadores selecionados e organizações especializadas, mediante inscrição. A ferramenta apenas informará se há uma marca-d’água da OpenAI no texto; não revelará quem o escreveu nem os prompts usados.
Por que importa
Usuários da UE verão um marcador oculto nas respostas do ChatGPT que os órgãos reguladores poderão ler, ajudando a cumprir as novas regras de identificação. Desenvolvedores poderão optar por ocultar o marcador, o que pode dificultar que terceiros identifiquem textos gerados por IA. A baixa taxa de detecção após edições indica que ainda será possível remover a marca-d’água com pequenas reformulações.