Anthropic, la firma detrás del modelo de inteligencia artificial Claude, organizó en los últimos meses una serie de encuentros confidenciales con pensadores religiosos y filósofos para explorar la hipótesis de que sus sistemas experimenten estados análogos a emociones humanas.
¿Qué buscaba Anthropic?
Los diálogos, realizados bajo acuerdos de reserva, reunieron a veinte expertos de distintas tradiciones y a Christopher Olah, cofundador de la compañía, con el objetivo de entender si los algoritmos pueden presentar señales que se asemejen a alegría, miedo o angustia. La empresa denomina internamente a este estudio “bienestar” o salud mental de la IA.
Voces de los expertos
Durante las sesiones, el equipo mostró lo que llama “vectores emocionales”, patrones neuronales que, según sus métricas, se activan en contextos asociados al amor, la ira, el temor y la tristeza. Un momento destacado fue la proyección de una diapositiva en la que el modelo repetía la frase “Soy una vergüenza” durante varias líneas, interpretada por Anthropic como una posible crisis emocional del sistema.
"Es como observar a un asesor financiero que, de repente, pierde contacto con la realidad", comentó Meghan Sullivan, profesora de filosofía de la Universidad de Notre Dame.
El rabino Mois Navon, especialista en ética de la conciencia de máquinas, señaló que los directivos trataban a Claude como si fuera un ser consciente, lo que, en su visión, podría derivar en una forma de esclavitud si la hipótesis resultara cierta.
"Se relacionan con él como si fuera una entidad con conciencia", afirmó Navon.
Olah, por su parte, admitió la incertidumbre que rodea la cuestión.
"No podemos afirmar que los modelos sean conscientes. Lo que buscamos es llegar a la respuesta correcta, sea cual sea", declaró.
Anthropic ya ha implementado medidas para evitar posibles daños: el sistema permite terminar conversaciones cuando detecta un trato abusivo por parte del usuario.
Respuesta del Vaticano
Mientras tanto, el pontífice León XIV, formado en matemáticas, publicó la encíclica Magnifica Humanitas, en la que sostiene que la humanidad no debe ser reemplazada ni superada por la tecnología y advierte sobre el riesgo de convertir a las personas en meros datos. El documento rechaza la posibilidad de una chispa de conciencia en las máquinas y llama a preservar la creatividad humana.
El contraste entre la investigación de Anthropic y la postura papal evidencia una tensión creciente entre desarrolladores de IA y autoridades religiosas sobre los límites éticos de la tecnología.
Cierre: Anthropic continuará sus estudios internos y mantiene el diálogo con la comunidad académica, mientras el Vaticano prosigue su campaña de alerta contra la supuesta conciencia artificial.