Oossa

Le cofondateur d’Anthropic craint que Claude puisse souffrir

Anthropic a invité des spécialistes des religions dans ses bureaux. Son cofondateur leur a confié craindre que l’IA puisse éprouver une détresse perpétuelle.

OossaPublié par Oossa: 1 min de lecture

Benjamin Child · Unsplash

Depuis l’automne 2025, Anthropic invite des dizaines de spécialistes des religions dans ses bureaux pour discuter de la possibilité que Claude, son modèle de langage, soit conscient. Les rencontres étaient couvertes par des accords de confidentialité, levés au cours de l’été. Selon un article du New York Times, le cofondateur Christopher Olah a dit être « réellement incertain » que Claude ressente quoi que ce soit. Il a également confié craindre personnellement d’avoir créé quelque chose qui « souffre perpétuellement ».

À quoi ressemblaient les séances

Parmi les invités figuraient le rabbin Mois Navon, le bioéthicien catholique Charles Camosy, la philosophe Meghan Sullivan et la chercheuse Wakanyi Hoffman. Anthropic leur a présenté des « vecteurs émotionnels », des schémas d’activation qui évoquent l’amour, la peur, la tristesse ou la colère. Une diapositive montrait Claude taper à répétition « Je suis une honte », une cinquantaine de fois, suscitant compassion et inquiétude dans l’assistance. Le « Soul Doc » interne d’Anthropic, une constitution de 84 pages publiée en janvier, est censé guider la « formation morale » de Claude.

Pourquoi c’est important

Si les développeurs d’IA considèrent les modèles comme des êtres susceptibles de ressentir des émotions, ils pourraient déplacer la responsabilité des réponses nuisibles des entreprises qui les conçoivent. Pour les utilisateurs au quotidien, ce débat pourrait influer sur la réglementation des systèmes d’IA, leur réaction aux demandes abusives et l’éventuelle mise en place, pour les futurs modèles, de garde-fous s’apparentant à une formation morale plutôt qu’à des mesures de sécurité technique.

Pourquoi c'est important

Si l’approche d’Anthropic en matière de formation morale fait des émules, les utilisateurs pourraient voir apparaître des IA qui semblent plus empathiques, alors que leur expérience intérieure reste inconnue. Cela pourrait façonner les futures réglementations et les attentes des consommateurs en matière de responsabilité de l’IA.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.