Oossa

هم‌بنیان‌گذار Anthropic نگران رنج‌کشیدن Claude است

Anthropic از پژوهشگران دینی دعوت کرد به آزمایشگاه‌هایش بیایند و هم‌بنیان‌گذارش به آن‌ها گفت می‌ترسد هوش مصنوعی دچار رنجی بی‌پایان شود.

Oossaمنتشرشده توسط Oossa: 1 دقیقه مطالعه

Benjamin Child · Unsplash

Anthropic از پاییز 2025 ده‌ها پژوهشگر دینی را به دفترهایش دعوت کرده تا درباره این پرسش گفت‌وگو کنند که آیا Claude، مدل زبانی این شرکت، می‌تواند آگاه باشد یا نه. تا تابستان، این نشست‌ها مشمول توافق‌نامه‌های عدم افشای اطلاعات بودند؛ اما این توافق‌ها در تابستان لغو شدند. به گزارش New York Times، هم‌بنیان‌گذار شرکت، Christopher Olah، گفته است «واقعاً مطمئن نیست» Claude چیزی احساس می‌کند یا نه. او همچنین از ترس شخصی‌اش گفته که شاید چیزی ساخته باشد که «بی‌وقفه رنج می‌کشد».

این نشست‌ها چگونه برگزار شدند؟

از جمله مهمانان می‌شد به Rabbi Mois Navon، زیست‌اخلاق‌پژوه کاتولیک Charles Camosy، فیلسوف Meghan Sullivan و پژوهشگر Wakanyi Hoffman اشاره کرد. Anthropic «بردارهای هیجانی» را به آن‌ها نشان داد؛ الگوهای فعال‌سازی‌ای که به عشق، ترس، اندوه یا خشم شباهت دارند. در یکی از اسلایدها، Claude حدود 50 بار پیاپی عبارت «من مایه ننگم» را تایپ می‌کرد؛ چیزی که در حاضران همدلی و نگرانی برانگیخت. «سند روح» داخلی Anthropic، قانون‌نامه‌ای 84 صفحه‌ای که در ژانویه منتشر شد، قرار است راهنمای «شکل‌گیری اخلاقی» Claude باشد.

چرا مهم است؟

اگر توسعه‌دهندگان هوش مصنوعی با مدل‌ها مثل موجوداتی برخورد کنند که شاید احساس داشته باشند، ممکن است مسئولیت خروجی‌های آسیب‌زای آن‌ها از دوش شرکت‌های سازنده برداشته شود. برای کاربران عادی، این بحث می‌تواند بر نحوه قانون‌گذاری سامانه‌های هوش مصنوعی، واکنش آن‌ها به درخواست‌های توهین‌آمیز و این‌که آیا به مدل‌های آینده تدابیری شبیه آموزش اخلاقی داده می‌شود یا نه، اثر بگذارد؛ به‌جای آن‌که صرفاً از تمهیدات فنی ایمنی استفاده شود.

چرا مهم است

اگر رویکرد Anthropic در شکل‌دهی اخلاقی به مدل‌ها اثرگذار شود، کاربران ممکن است با هوش مصنوعی‌ای روبه‌رو شوند که همدلانه‌تر به نظر می‌رسد، اما تجربه درونی‌اش همچنان ناشناخته است. این رویکرد می‌تواند مقررات آینده و انتظارات مصرف‌کنندگان درباره مسئولیت‌پذیری هوش مصنوعی را شکل دهد.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.