Depuis l’automne 2025, Anthropic invite des dizaines de spécialistes des religions dans ses bureaux pour discuter de la possibilité que Claude, son modèle de langage, soit conscient. Les rencontres étaient couvertes par des accords de confidentialité, levés au cours de l’été. Selon un article du New York Times, le cofondateur Christopher Olah a dit être « réellement incertain » que Claude ressente quoi que ce soit. Il a également confié craindre personnellement d’avoir créé quelque chose qui « souffre perpétuellement ».
À quoi ressemblaient les séances
Parmi les invités figuraient le rabbin Mois Navon, le bioéthicien catholique Charles Camosy, la philosophe Meghan Sullivan et la chercheuse Wakanyi Hoffman. Anthropic leur a présenté des « vecteurs émotionnels », des schémas d’activation qui évoquent l’amour, la peur, la tristesse ou la colère. Une diapositive montrait Claude taper à répétition « Je suis une honte », une cinquantaine de fois, suscitant compassion et inquiétude dans l’assistance. Le « Soul Doc » interne d’Anthropic, une constitution de 84 pages publiée en janvier, est censé guider la « formation morale » de Claude.
Pourquoi c’est important
Si les développeurs d’IA considèrent les modèles comme des êtres susceptibles de ressentir des émotions, ils pourraient déplacer la responsabilité des réponses nuisibles des entreprises qui les conçoivent. Pour les utilisateurs au quotidien, ce débat pourrait influer sur la réglementation des systèmes d’IA, leur réaction aux demandes abusives et l’éventuelle mise en place, pour les futurs modèles, de garde-fous s’apparentant à une formation morale plutôt qu’à des mesures de sécurité technique.
Pourquoi c'est important
Si l’approche d’Anthropic en matière de formation morale fait des émules, les utilisateurs pourraient voir apparaître des IA qui semblent plus empathiques, alors que leur expérience intérieure reste inconnue. Cela pourrait façonner les futures réglementations et les attentes des consommateurs en matière de responsabilité de l’IA.