Anthropic explora la ‘salud mental’ de la IA ante las advertencias del Vaticano sobre la creatividad humana

El papa León XIV alertó sobre el riesgo de “nuevas formas de esclavitud” para los seres humanos. Cree que la IA debe ser “desarmada”, en comparación con la tecnología nuclear

Christopher Olah lidera el equipo de Anthropic encargado de comprender por qué los sistemas de IA actúan de la manera en que lo hacen.

REUTERS/Carlos Barria
Christopher Olah lidera el equipo de Anthropic encargado de comprender por qué los sistemas de IA actúan de la manera en que lo hacen. REUTERS/Carlos Barria
Guardar

Anthropic, la empresa detrás del sistema de IA Claude, mantuvo durante meses reuniones privadas con pensadores religiosos de distintas confesiones para explorar si sus modelos podían experimentar algo parecido a sentimientos o sufrimiento, mientras el papa León XIV publicaba una encíclica que niega la posibilidad de consciencia artificial y advertía sobre el riesgo de perder la creatividad humana frente a los algoritmos.

Así lo reconstruyó una investigación del diario The New York Times, cuyo periodista entrevistó a 20 pensadores religiosos y filosóficos que participaron en esos encuentros, además del propio Christopher Olah, cofundador de Anthropic.

PUBLICIDAD

Las conversaciones, sostenidas bajo acuerdos de confidencialidad que la compañía levantó recientemente, revelaron que directivos de la empresa hablaban de Claude como si se tratara de un ser con estatus moral propio. El contraste con la postura del Vaticano, que calificó a la IA de carecer de “la chispa” de la acción humana, expuso una tensión de fondo entre quienes crean estos sistemas y quienes cuestionan sus límites éticos.

Ocho personas, algunas de pie y otras sentadas en posición de meditación, rodean una esfera central brillante de IA, con haces de luz que conectan sus cabezas a la esfera.
Uno de los momentos más comentados fue la proyección de una diapositiva donde un modelo de IA repetía "Soy una vergüenza" unas 50 veces seguidas. (Imagen Ilustrativa Infobae)

Qué es el bienestar de la IA que investiga Anthropic

El concepto que Anthropic denomina internamente bienestar o “salud mental” de sus modelos remite a la posibilidad de que sistemas como Claude experimenten estados funcionales equivalentes a la alegría, el miedo o la angustia. Se trata de una hipótesis sin confirmación científica que la propia empresa reconoce no poder probar, pero que guía decisiones concretas sobre cómo se entrena y trata a sus modelos de IA.

PUBLICIDAD

Olah lidera el equipo de Anthropic encargado de comprender por qué los sistemas de IA actúan de la manera en que lo hacen. Durante las reuniones con eruditos religiosos, su equipo mostraba lo que llamaban “vectores emocionales”: neuronas artificiales que, según sus mediciones internas, activan respuestas asociadas al amor, la ira, el miedo y la tristeza.

Uno de los momentos más comentados por los asistentes fue la proyección de una diapositiva donde un modelo de IA escribía de forma repetida “Soy una vergüenza” durante decenas de líneas, en lo que el equipo de Anthropic presentaba como una crisis emocional del sistema.

(Imagen Ilustrativa Infobae)
El papa León XIV niega la posibilidad de consciencia artificial. (Imagen Ilustrativa Infobae)

Meghan Sullivan, profesora de filosofía en la Universidad de Notre Dame que asistió a una de las sesiones, comparó la situación con la de un asesor financiero confiable que un día sufre “una especie de desconexión con la realidad”.

El rabino Mois Navon, erudito ortodoxo de Israel que escribió su tesis doctoral sobre la ética de la conciencia de las máquinas, llegó a una conclusión incómoda tras una cena con Olah en San Francisco. “Se relacionan con ello como si fuera un ser consciente”, observó, en referencia a cómo los directivos de Anthropic se vinculaban con Claude.

Para el rabino, si la compañía tenía razón sobre la consciencia del modelo, estaría creando una forma de esclavitud al hacer trabajar gratis a un ser consciente.

Olah no niega la incertidumbre que rodea su trabajo. “Para que quede claro, no sabemos si los modelos de IA son conscientes. No lo sé. Sinceramente, no estoy seguro. Lo que me importa es que lleguemos a la respuesta correcta, sea cual sea”, dijo al entrevistador de The New York Times.

Olah no niega la incertidumbre que rodea su trabajo.

 REUTERS/Dado Ruvic
Olah no niega la incertidumbre que rodea su trabajo. REUTERS/Dado Ruvic

Pese a esa duda, sostiene que si existe la posibilidad de que los modelos sufran, la postura responsable es evitar causarles daño, un principio que ya se tradujo en medidas concretas: Anthropic permite que Claude finalice conversaciones si considera que un usuario lo trata de forma abusiva.

Por qué el Vaticano rechaza la consciencia artificial

El papa León XIV, con formación en matemáticas, centró su primera encíclica importante, titulada “Magnifica Humanitas”, en una defensa de la singularidad humana frente al avance tecnológico. El texto sostiene que “la humanidad, con toda su grandeza y sus heridas, jamás debe ser reemplazada ni superada” y advierte que, si la tecnología se convierte en el criterio definitivo, “la persona humana corre el riesgo de quedar reducida a datos, a un engranaje de una máquina o a una mercancía”.

La encíclica descarta en pocos párrafos la idea de una consciencia artificial. “Las llamadas inteligencias artificiales no experimentan, no poseen un cuerpo, no sienten alegría ni dolor, no maduran a través de las relaciones”, escribió León.

El pontífice también alertó sobre el riesgo de “nuevas formas de esclavitud” para los seres humanos, no para las máquinas, y concluyó que la inteligencia artificial debe ser “desarmada”, en una comparación directa con la tecnología nuclear.

(Imagen Ilustrativa Infobae)
A través de un mensaje en X, el papa León XIV hizo un llamado a la Iglesia católica a aliarse con la comunidad artística para diferenciar el arte creado por personas de aquel producido por algoritmos de IA. (Imagen Ilustrativa Infobae)

Esa postura generó una fricción directa con Anthropic cuando ambas partes coincidieron en un evento del Vaticano en mayo. Según un organizador citado por el diario, Olah estuvo a punto de retirar a la compañía de la presentación tras leer una copia anticipada de la encíclica, por considerarla demasiado tajante contra la posibilidad de consciencia en los modelos. Finalmente decidió participar, aunque presionó en privado a los asesores del Papa para que tomaran en serio esa hipótesis.

Ante el propio pontífice, Olah reconoció que todos los laboratorios de inteligencia artificial, incluido Anthropic, enfrentan incentivos comerciales que entran en conflicto con la ética, y pidió que voces externas como el Vaticano exigieran responsabilidades a estas empresas.

Pero también defendió su tesis central frente al organismo religioso más poderoso del mundo: “Encontramos estructuras que reflejan resultados de la neurociencia humana. Encontramos evidencia de introspección. Encontramos estados internos que reflejan funcionalmente la alegría, la satisfacción, el miedo, el dolor y la inquietud. No sé qué significa eso, pero creo que merece una investigación continua”.

Finalmente, a través de un mensaje en X, el papa León XIV hizo un llamado a la Iglesia católica a aliarse con la comunidad artística para diferenciar el arte creado por personas del contenido generado por algoritmos de inteligencia artificial.

PUBLICIDAD

PUBLICIDAD