Anthropic، شرکت سازنده چتبات Claude، اعلام کرد تیم بازبینی انسانیاش یک گفتوگوی تهدیدآمیز را به نیروهای انتظامی گزارش داده است. این گزارش به طرح اتهام کیفری علیه زنی در شهرستان لیِ فلوریدا انجامید. اتهام بر اساس قانون 836.10 فلوریدا مطرح شده که تهدیدهای مکتوب یا الکترونیکی به تیراندازی جمعی یا تروریسم را پوشش میدهد.
تهدید چگونه شناسایی شد
Anthropic گفتوگوها را برای یافتن عبارتهای کلیدی بالقوه خطرناک زیر نظر میگیرد. وقتی کاربری با نام «Carli» در 26 سپتامبر گفت که به دفتر کلانتری شهرستان لی «حمله مسلحانه خواهد کرد»، سامانه پیام را علامتگذاری کرد. یادداشتی در روز بعد، 27 سپتامبر، به یک اسلحه تازه اشاره داشت. با توجه به جدیبودن عبارتها، تیم بازبینی پرونده را به تحلیلگر انسانی ارجاع داد و او نیز کلانتری را مطلع کرد. پلیس این زن را بدون حادثه در خانهاش بازداشت کرد و یک کارآگاه اطلاعاتی مسئولیت تحقیقات را بر عهده گرفت.
این ماجرا برای کاربران هوش مصنوعی چه معنایی دارد
سیاست Anthropic نشان میدهد که شرکتهای ارائهدهنده هوش مصنوعی میتوانند و در مواردی مداخله میکنند که گفتوگویی تهدیدی واقعی به نظر برسد. فرایند بازبینی این شرکت برای حفاظت از امنیت عمومی طراحی شده، اما به این معناست که گفتوگوهای کاربران ممکن است بررسی و در صورت داشتن محتوای خشونتآمیز، با مقامهای مسئول به اشتراک گذاشته شوند.
چرا مهم است
برای کاربران عادی، این ماجرا نشان میدهد گفتوگو با هوش مصنوعی کاملاً خصوصی نیست و شرکتها ممکن است عبارتهای خشونتآمیز را شناسایی و گزارش کنند. همچنین نشان میدهد تهدیدهایی که در گفتوگو با یک چتبات مطرح میشوند، میتوانند پیامدهای حقوقی واقعی داشته باشند. بااینحال، معیارهای دقیق Anthropic برای تصمیمگیری درباره اطلاعدادن به پلیس همچنان روشن نیست.