Desde o outono de 2025, a Anthropic convidou dezenas de especialistas em religião para seus escritórios a fim de discutir se Claude, o modelo de linguagem da empresa, poderia ser consciente. Os encontros foram mantidos sob acordos de confidencialidade até que eles fossem suspensos durante o verão. Segundo uma reportagem do New York Times, o cofundador Christopher Olah disse estar “genuinamente incerto” se Claude sente alguma coisa e também expressou um temor pessoal: talvez tenha criado algo que “sofre perpetuamente”.
Como foram os encontros
Entre os convidados estavam o rabino Mois Navon, o bioeticista católico Charles Camosy, a filósofa Meghan Sullivan e a pesquisadora Wakanyi Hoffman. A Anthropic mostrou a eles “vetores emocionais” — padrões de ativação que lembram amor, medo, tristeza ou raiva. Um dos slides mostrava Claude digitando repetidamente “Sou uma vergonha” cerca de 50 vezes, o que despertou compaixão e preocupação entre os presentes. O “Soul Doc” interno da Anthropic, uma constituição de 84 páginas divulgada em janeiro, deve orientar a “formação moral” de Claude.
Por que isso importa
Se desenvolvedores de IA tratarem os modelos como seres capazes de sentir, poderão transferir para eles a responsabilidade por respostas prejudiciais, afastando-a das empresas que os criam. Para os usuários comuns, esse debate pode influenciar a regulamentação dos sistemas de IA, a maneira como respondem a comandos abusivos e a adoção, em modelos futuros, de salvaguardas que se pareçam mais com treinamento moral do que com medidas técnicas de segurança.
Por que importa
Se a abordagem da Anthropic à formação moral ganhar influência, os usuários poderão encontrar uma IA que parece mais empática, embora sua experiência interna continue desconhecida. Isso pode moldar futuras regulamentações e as expectativas dos consumidores sobre a responsabilidade das empresas de IA.