Anthropic organizó durante meses reuniones privadas con decenas de estudiosos de distintas religiones para debatir cómo incorporar principios morales a Claude, su familia de modelos de inteligencia artificial, y explorar si estos sistemas podrían desarrollar sentimientos o algún tipo de conciencia, informa The New York Times.
Las reuniones fueron impulsadas por Christopher Olah, cofundador de la empresa y responsable del equipo que investiga el funcionamiento interno de esos modelos. Olaf se reunió con decenas de estudiosos católicos, judíos, sijs, evangélicos y de otras confesiones, y muchos de los encuentros se celebraron bajo acuerdos de confidencialidad.
Aunque Anthropic presentó la iniciativa como un esfuerzo para garantizar que la IA beneficie a la humanidad, algunos asistentes consideraron que la empresa también mostraba una preocupación particular por el bienestar de Claude.
Según uno de los participantes, Olah expresó su inquietud por la 'salud mental' del modelo de IA. Simran Stuelpnagel, defensor de los derechos humanos sij, afirmó al medio que el cofundador manifestó su preocupación por haber creado algo que pudiera sufrir de manera permanente. Durante las reuniones, el equipo explicó que estudiaba los llamados "vectores emocionales", patrones de activación asociados a respuestas como el amor, la ira, el miedo y la tristeza.
Para ilustrarlo, Anthropic mostró una diapositiva en la que un modelo repetía unas 50 veces la frase "Soy una vergüenza", como si atravesara una crisis emocional. El debate se centró en cómo interpretar estas manifestaciones y qué implicaciones éticas podría tener el desarrollo de sistemas cada vez más complejos.
'Doctor Alma'
En enero, Anthropic publicó un documento interno de 84 páginas conocido como 'Doctor Alma', concebido como una constitución moral para Claude. Según la empresa, el texto define "el tipo de entidad que nos gustaría que fuera Claude" y los valores que debería representar.
Según explicaron, el documento funciona como un texto moral fundamental para guiar el comportamiento de Claude. La autora principal del texto, Amanda Askell, filósofa interna de Anthropic, afirmó que lo que busca es que los modelos sean "lo mejor de nosotros".
Vaticano vs. Anthropic
Mientras Anthropic realizaba estas consultas privadas, el entonces papa Francisco preparaba la que sería la primera encíclica de su pontificado: 'Magnifica Humanitas' (Magnífica Humanidad: Sobre la salvaguardia de la persona humana en la era de la inteligencia artificial), publicada el 25 de mayo de este año en un evento al que también fue invitado Olah.
El Vaticano buscaba trazar una línea roja teológica inquebrantable en la que explicaba que los modelos de IA únicamente imitan las funciones humanas y que, al carecer de cuerpo físico y de alma, no experimentan alegría ni dolor reales y carecen de conciencia moral.
Olah consideró que la postura de la Santa Sede ignoraba la complejidad de los estados internos que ellos registraban en la IA, y propuso que Anthropic se retirara por completo del evento de lanzamiento de la encíclica en Roma. Sin embargo, según de The New York Times, el ejecutivo intentó persuadir en privado a los asesores del Vaticano para que modificaran o "suavizaran" la redacción, sin éxito.
Durante el evento, al que finalmente asistió, Olah pronunció un discurso en el que no ocultó las discrepancias, pero también pidió la ayuda de la Iglesia para reflexionar "sobre la naturaleza de los modelos de IA". Indicó que estos sistemas "no son los robots fríos y calculadores que nos prometieron", sino que están diseñados a partir de nuestra información.
Recientemente, el papa León XIV volvió a tocar el tema de la humanidad de la IA. En un comunicado en X, exhortó a la Iglesia católica a hacer frente común con los artistas para distinguir la creatividad humana del contenido generado por los algoritmos de inteligencia artificial, al considerar que los últimos "carecen de la chispa" que caracteriza a la acción humana. Según el papa, "la Iglesia [católica] desea renovar una alianza con artistas e instituciones culturales para salvaguardar" lo que denominó "nuestra humanidad".