OpenAI introdurrà nelle prossime settimane textGrain, un watermark invisibile per alcuni testi generati da ChatGPT e Codex nell’Unione Europea. La società lo presenta come un modo per rendere i contenuti riconoscibili dai sistemi automatici, in linea con gli obblighi dell’AI Act. Non ha precisato quali testi saranno considerati «idonei».
Il watermark modifica in modo statistico la scelta delle parole; un detector cerca poi quel segnale nel testo. OpenAI afferma che nei suoi test il metodo ha eguagliato o superato le alternative valutate, incluso SynthID for text di Google. Ma avverte anche che una riscrittura può indebolirlo.
Quanto resiste alle modifiche?
Nei test descritti, condotti su risposte in inglese a domande del dataset ELI5, il rilevamento di testi da 200 token è sceso dal 66% al 38% quando è stato sostituito il 10% delle parole. Su testi da 400 token, la stessa quota di modifiche ha portato il risultato al 66%. Sostituendo un quarto delle parole, il tasso è sceso al 7% su 200 token e al 17% su 400.
Sono risultati riportati da OpenAI, non una verifica indipendente. La società indica anche un tasso di falsi positivi dell’1%: in quella quota di casi, il detector segnala per errore testi senza watermark. La capacità di rilevamento dipende inoltre dalla lunghezza e dall’argomento: nei passaggi di psicologia citati, è circa l’80% a 200 token e il 95% a 400; in matematica, rispettivamente il 52% su 300 token e il 61% su 400.
Chi lo troverà nei propri testi?
Nell’UE il watermark sarà applicato ai testi idonei di ChatGPT e Codex su tutti i piani, ma non sarà attivo ovunque al lancio. Il codice di condotta esclude, tra gli altri, testi sotto i 200 token, frammenti di codice e interventi di semplice editing. Nell’API sarà invece facoltativo, disattivato per impostazione predefinita e disponibile per alcuni modelli; potranno usarlo anche i fornitori cloud.
Il detector non sarà pubblico: OpenAI accetta richieste di accesso da ricercatori e organizzazioni, valutandole caso per caso. La società intende pubblicare la tecnologia come open source e aggiornare il rapporto tecnico.
Perché conta
Per chi usa ChatGPT o Codex nell’UE, alcuni testi generati potranno avere un segnale invisibile, ma non tutti: OpenAI non ha ancora chiarito quali rientrino nella categoria «idonei». I test pubblicati dalla società mostrano che modifiche anche limitate possono rendere il segnale più difficile da rilevare; resta da vedere quanto il metodo funzionerà sui testi reali e con detector usati da terzi.