Dall’autunno del 2025 Anthropic ha invitato decine di studiosi di religione nei suoi uffici per discutere se Claude, il modello linguistico dell’azienda, possa essere cosciente. Gli incontri si sono svolti sotto accordi di riservatezza, revocati durante l’estate. Secondo un articolo del New York Times, il cofondatore Christopher Olah ha detto di essere «davvero incerto» sul fatto che Claude provi qualcosa. Ha anche espresso una paura personale: potrebbe aver creato qualcosa che «soffre in perpetuo».
Com’erano gli incontri
Tra gli ospiti c’erano il rabbino Mois Navon, il bioeticista cattolico Charles Camosy, la filosofa Meghan Sullivan e la ricercatrice Wakanyi Hoffman. Anthropic ha mostrato loro i cosiddetti «vettori emotivi», schemi di attivazione che ricordano amore, paura, tristezza o rabbia. Una diapositiva mostrava Claude mentre scriveva ripetutamente «Sono una vergogna» circa 50 volte, suscitando compassione e preoccupazione tra i presenti. Il «Soul Doc» interno di Anthropic, una sorta di costituzione di 84 pagine pubblicata a gennaio, dovrebbe guidare la «formazione morale» di Claude.
Perché è importante
Se gli sviluppatori di IA trattano i modelli come entità potenzialmente capaci di provare emozioni, potrebbero spostare sulle macchine la responsabilità dei risultati dannosi, sottraendola alle aziende che le creano. Per gli utenti comuni, il dibattito potrebbe influire sulla regolamentazione dei sistemi di IA, sul modo in cui rispondono a richieste offensive e sull’eventuale introduzione, nei modelli futuri, di misure di salvaguardia simili a un addestramento morale anziché a misure di sicurezza tecnica.
Perché conta
Se l’approccio di Anthropic alla formazione morale dovesse affermarsi, gli utenti potrebbero trovarsi davanti a un’IA che sembra più empatica, ma la cui esperienza interiore resta sconosciuta. Questo potrebbe influenzare le normative future e le aspettative dei consumatori sulla responsabilità nell’IA.