Anthropic از پاییز 2025 دهها پژوهشگر دینی را به دفترهایش دعوت کرده تا درباره این پرسش گفتوگو کنند که آیا Claude، مدل زبانی این شرکت، میتواند آگاه باشد یا نه. تا تابستان، این نشستها مشمول توافقنامههای عدم افشای اطلاعات بودند؛ اما این توافقها در تابستان لغو شدند. به گزارش New York Times، همبنیانگذار شرکت، Christopher Olah، گفته است «واقعاً مطمئن نیست» Claude چیزی احساس میکند یا نه. او همچنین از ترس شخصیاش گفته که شاید چیزی ساخته باشد که «بیوقفه رنج میکشد».
این نشستها چگونه برگزار شدند؟
از جمله مهمانان میشد به Rabbi Mois Navon، زیستاخلاقپژوه کاتولیک Charles Camosy، فیلسوف Meghan Sullivan و پژوهشگر Wakanyi Hoffman اشاره کرد. Anthropic «بردارهای هیجانی» را به آنها نشان داد؛ الگوهای فعالسازیای که به عشق، ترس، اندوه یا خشم شباهت دارند. در یکی از اسلایدها، Claude حدود 50 بار پیاپی عبارت «من مایه ننگم» را تایپ میکرد؛ چیزی که در حاضران همدلی و نگرانی برانگیخت. «سند روح» داخلی Anthropic، قانوننامهای 84 صفحهای که در ژانویه منتشر شد، قرار است راهنمای «شکلگیری اخلاقی» Claude باشد.
چرا مهم است؟
اگر توسعهدهندگان هوش مصنوعی با مدلها مثل موجوداتی برخورد کنند که شاید احساس داشته باشند، ممکن است مسئولیت خروجیهای آسیبزای آنها از دوش شرکتهای سازنده برداشته شود. برای کاربران عادی، این بحث میتواند بر نحوه قانونگذاری سامانههای هوش مصنوعی، واکنش آنها به درخواستهای توهینآمیز و اینکه آیا به مدلهای آینده تدابیری شبیه آموزش اخلاقی داده میشود یا نه، اثر بگذارد؛ بهجای آنکه صرفاً از تمهیدات فنی ایمنی استفاده شود.
چرا مهم است
اگر رویکرد Anthropic در شکلدهی اخلاقی به مدلها اثرگذار شود، کاربران ممکن است با هوش مصنوعیای روبهرو شوند که همدلانهتر به نظر میرسد، اما تجربه درونیاش همچنان ناشناخته است. این رویکرد میتواند مقررات آینده و انتظارات مصرفکنندگان درباره مسئولیتپذیری هوش مصنوعی را شکل دهد.