Anthropic, l’azienda che sviluppa il chatbot Claude, ha dichiarato che il suo team di revisione umana ha segnalato alle forze dell’ordine una conversazione minacciosa. La segnalazione ha portato all’incriminazione di una donna nella contea di Lee, in Florida. L’accusa è stata formulata ai sensi della legge della Florida 836.10, che punisce le minacce scritte o elettroniche di una sparatoria di massa o di terrorismo.
Come è stata rilevata la minaccia
Anthropic monitora le chat per individuare espressioni che potrebbero indicare un pericolo. Il 26 settembre, quando un’utente identificata come “Carli” ha detto che avrebbe «fatto una sparatoria» presso l’ufficio dello sceriffo della contea di Lee, il sistema ha segnalato il messaggio. In una nota successiva, del 27 settembre, si parlava di una nuova pistola. Dato che il linguaggio è stato giudicato grave, il team di revisione ha sottoposto il caso a un analista umano, che ha poi avvisato l’ufficio dello sceriffo. La polizia ha fermato la donna a casa sua, senza incidenti, e un detective specializzato in intelligence ha assunto la direzione delle indagini.
Cosa significa per chi usa l’IA
Le politiche di Anthropic mostrano che i fornitori di IA possono intervenire, e lo fanno, quando una conversazione sembra contenere una minaccia concreta. La procedura di revisione dell’azienda è pensata per proteggere la sicurezza pubblica, ma implica anche che le chat degli utenti possano essere esaminate e condivise con le autorità se contengono intenti violenti.
Perché conta
Per chi usa l’IA nella vita di tutti i giorni, la vicenda mostra che le chat con i chatbot non sono del tutto private: i fornitori possono segnalare e denunciare alle autorità il linguaggio violento. Dimostra inoltre che le minacce rivolte a un chatbot possono avere conseguenze legali concrete. Restano però poco chiari i criteri esatti con cui Anthropic decide quando coinvolgere la polizia.