Oossa

Anthropic anmälde hot från Claude – kvinna i Florida åtalas

En kvinna i Lee County åtalades efter att en hotfull konversation med Anthropics AI Claude flaggats och lämnats över till polisen.

OossaPublicerad av Oossa: 1 min läsning

WrS.tm.pl · Unsplash

Anthropic, företaget bakom chattboten Claude, uppger att dess team för mänsklig granskning anmälde en hotfull konversation till polisen. Anmälan ledde till att en kvinna i Lee County i Florida åtalades för ett grovt brott. Åtalet väcktes med stöd av Floridas lag 836.10, som gäller skriftliga eller elektroniska hot om en masskjutning eller terrorism.

Så upptäcktes hotet

Anthropic bevakar chattar efter nyckelfraser som kan tyda på fara. När en användare vid namn ”Carli” den 26 september sade att hon skulle ”skjuta upp” Lee County Sheriff’s Office flaggade systemet meddelandet. En uppföljande anteckning den 27 september nämnde ett nytt vapen. Eftersom formuleringarna bedömdes som allvarliga skickade granskningsteamet ärendet vidare till en mänsklig analytiker, som därefter larmade sheriffkontoret. Polisen omhändertog kvinnan i hennes hem utan incidenter, och en underrättelseutredare tog över utredningen.

Vad det innebär för AI-användare

Anthropics policy visar att AI-leverantörer kan ingripa – och gör det – när en konversation verkar innehålla ett verkligt hot. Företagets granskningsprocess är utformad för att skydda allmänheten, men innebär också att användarchattar kan granskas och delas med myndigheter om de innehåller våldsavsikter.

Varför det spelar roll

För vanliga användare visar händelsen att AI-chattar inte är helt privata: leverantörer kan flagga och anmäla våldsamt språk. Den visar också att hotfulla uttalanden till en chattbot kan få verkliga rättsliga följder. Det är dock fortfarande oklart exakt vilka kriterier Anthropic använder för att avgöra när polisen ska kopplas in.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.