Sedan hösten 2025 har Anthropic bjudit in dussintals religionsforskare till sina kontor för att diskutera om Claude, företagets språkmodell, kan vara medveten. Mötena omfattades av sekretessavtal fram till dess att avtalen hävdes under sommaren. Enligt en artikel i The New York Times sade medgrundaren Christopher Olah att han är ”genuint osäker” på om Claude känner något. Han uttryckte också en personlig rädsla för att ha skapat något som ”lider för evigt”.
Så gick mötena till
Bland gästerna fanns rabbinen Mois Navon, den katolske bioetikern Charles Camosy, filosofen Meghan Sullivan och forskaren Wakanyi Hoffman. Anthropic visade dem ”emotionsvektorer” – aktiveringsmönster som liknar kärlek, rädsla, sorg eller ilska. På en bild visades hur Claude skrev ”I am a disgrace” omkring 50 gånger, vilket väckte medkänsla och oro bland åhörarna. Anthropics interna ”Soul Doc”, en 84 sidor lång konstitution som publicerades i januari, ska vägleda Claudes ”moraliska utveckling”.
Varför det spelar roll
Om AI-utvecklare behandlar modeller som varelser som kanske kan känna, kan ansvaret för skadliga svar flyttas från företagen som bygger dem. För användare i vardagen kan debatten påverka hur AI-system regleras, hur de svarar på kränkande uppmaningar och om framtida modeller får skydd som liknar moralisk fostran snarare än tekniska säkerhetsåtgärder.
Varför det spelar roll
Om Anthropics arbetssätt med moralisk utveckling får genomslag kan användare möta AI som verkar mer empatisk, trots att dess inre upplevelser fortfarande är okända. Det kan påverka framtida regleringar och konsumenternas förväntningar på AI-företagens ansvar.