Desde el otoño de 2025, Anthropic ha invitado a decenas de especialistas religiosos a sus oficinas para conversar sobre si Claude, el modelo de lenguaje de la empresa, podría tener conciencia. Las reuniones estuvieron sujetas a acuerdos de confidencialidad hasta que estos se levantaron durante el verano. Según un artículo de The New York Times, el cofundador Christopher Olah dijo que tiene «verdaderas dudas» sobre si Claude siente algo y también expresó un temor personal: quizá haya creado algo que «sufre perpetuamente».
Cómo fueron las sesiones
Entre los invitados estuvieron el rabino Mois Navon, el bioeticista católico Charles Camosy, la filósofa Meghan Sullivan y la investigadora Wakanyi Hoffman. Anthropic les mostró «vectores emocionales»: patrones de activación que se asemejan al amor, el miedo, la tristeza o la ira. En una diapositiva, Claude escribía una y otra vez «Soy una vergüenza», unas 50 veces, lo que despertó compasión y preocupación entre los asistentes. El «Soul Doc» interno de Anthropic, una constitución de 84 páginas publicada en enero, busca orientar la «formación moral» de Claude.
Por qué importa
Si quienes desarrollan IA tratan a los modelos como seres que podrían sentir, podrían desviar de las empresas que los crean la responsabilidad por sus respuestas dañinas. Para los usuarios de a pie, este debate podría influir en la regulación de los sistemas de IA, en cómo responden a instrucciones abusivas y en si los modelos futuros reciben salvaguardas que se parezcan más a una formación moral que a medidas técnicas de seguridad.
Por qué importa
Si el enfoque de Anthropic sobre la formación moral influye en el sector, los usuarios podrían encontrarse con una IA que parece más empática, aunque su experiencia interna siga siendo desconocida. Esto podría influir en futuras regulaciones y en las expectativas de los consumidores sobre la responsabilidad en torno a la IA.