Anthropic, l’entreprise à l’origine du chatbot Claude, indique que son équipe de modération humaine a signalé aux forces de l’ordre une conversation menaçante. Ce signalement a débouché sur une inculpation pour crime dans le comté de Lee, en Floride. L’accusation a été portée en vertu de l’article 836.10 de la loi de Floride, qui vise les menaces écrites ou électroniques de fusillade de masse ou de terrorisme.
Comment la menace a été détectée
Anthropic surveille les conversations à la recherche de mots-clés susceptibles de signaler un danger. Le 26 septembre, lorsqu’une utilisatrice prénommée « Carli » a déclaré qu’elle allait « tirer dans » les locaux du bureau du shérif du comté de Lee, le système a signalé son message. Une note de suivi, le 27 septembre, faisait état d’une nouvelle arme à feu. Le contenu étant jugé grave, l’équipe de modération a transmis le dossier à un analyste humain, qui a ensuite alerté le bureau du shérif. La police a interpellé la femme à son domicile, sans incident, et un enquêteur spécialisé dans le renseignement a pris la suite de l’enquête.
Ce que cela signifie pour les utilisateurs d’IA
La politique d’Anthropic montre que les fournisseurs d’IA peuvent intervenir — et le font — lorsqu’une conversation ressemble à une menace réelle. La procédure d’examen de l’entreprise vise à protéger la sécurité publique, mais signifie aussi que les conversations des utilisateurs peuvent être examinées et communiquées aux autorités si elles évoquent des intentions violentes.
Pourquoi c'est important
Pour les utilisateurs au quotidien, cette affaire montre que les conversations avec une IA ne sont pas totalement privées : les fournisseurs peuvent signaler et transmettre aux autorités des propos violents. Elle montre aussi que des menaces adressées à un chatbot peuvent entraîner des conséquences judiciaires bien réelles. Toutefois, les critères précis qu’Anthropic applique pour décider d’alerter la police restent flous.