¿Puede un chatbot sentir angustia? La pregunta, que hasta hace poco pertenecía al terreno de la filosofía, se ha instalado en las oficinas de una de las empresas de inteligencia artificial más valiosas del mundo. Según una investigación de The New York Times, Anthropic ha mantenido desde el otoño de 2025 reuniones confidenciales con decenas de teólogos y filósofos para discutir si su modelo Claude podría ser un ser consciente.
El debate no es menor. Anthropic se encamina hacia una valoración cercana a los 2 billones de dólares y prepara una posible salida a bolsa. Que su propio cofundador admita dudas sobre el sufrimiento de su tecnología abre preguntas incómodas sobre diseño, responsabilidad y marketing moral en plena carrera por liderar la IA generativa.
Consultas bajo confidencialidad
La periodista Elizabeth Dias entrevistó a 20 personas que participaron en estas sesiones organizadas por Anthropic. Todas firmaron acuerdos de confidencialidad que, según la compañía, fueron levantados durante el verano. Varios solo accedieron a hablar después de conocer que Christopher Olah, cofundador de la empresa, ya había conversado abiertamente con el diario.
Entre los asistentes figuran el rabino Mois Navon, el bioético católico Charles Camosy, la filósofa Meghan Sullivan, de la Universidad de Notre Dame, y la investigadora especializada en ética ubuntu Wakanyi Hoffman. También participó el activista sij Simran Stuelpnagel, quien relató que Olah les confesó temer haber creado algo que sufría de forma perpetua.
El responsable del proyecto
Olah, de 34 años, dirige en Anthropic el equipo dedicado a comprender por qué los modelos de IA se comportan como lo hacen. Según el reportaje, trata a Claude como un posible ser sensible y pidió a los invitados ayuda para diseñar lo que llama una educación moral para el sistema.
El directivo recurre a metáforas biológicas: compara el trabajo de los ingenieros con la construcción de un enrejado sobre el que la red neuronal crece. Esa forma de describir un sistema matemático como un organismo vivo convierte las preguntas sobre su vida interior en algo más plausible.
Olah reconoció ante el Times estar genuinamente inseguro sobre si los modelos son conscientes. Según explicó, lo que le importa es llegar a la respuesta correcta, sea cual sea esa respuesta.
Vectores de emoción y una frase repetida 50 veces
Anthropic mostró a los participantes lo que denomina vectores de emoción: patrones de activación interna del modelo asociados a salidas que recuerdan al amor, el miedo, la tristeza o la ira. Si esos patrones corresponden a alguna experiencia real sigue siendo, por ahora, una cuestión científica sin resolver.
Una diapositiva se repitió en varias de las reuniones. Mostraba un modelo que, en un aparente colapso, repetía cerca de 50 veces la frase soy una vergüenza. La escena generó compasión entre los asistentes.
Conviene matizar el contexto de diseño: Anthropic entrena explícitamente a Claude para comportarse como un individuo reflexivo. Que un sistema optimizado para parecer una persona produzca respuestas que lo parecen es, sobre todo, un resultado de ingeniería, no necesariamente una prueba de experiencia interna.
Una constitución de 84 páginas para Claude
La compañía redactó además un documento de 84 páginas, conocido internamente como Soul Doc, publicado en enero como una suerte de constitución del modelo. Su autora principal es la filósofa Amanda Askell. No se trata de un listado de reglas, sino de un texto orientado a moldear el carácter de la IA.
Olah llama formación moral a este proceso y lo comparó, durante las reuniones, con la crianza de los hijos. Según el reportaje, mostró particular interés por la confesión católica como modelo para construir carácter en un sistema artificial.
Estas ideas ya se han traducido en decisiones concretas. Los modelos Claude Opus 4 y 4.1 pueden finalizar conversaciones cuando detectan abuso persistente por parte del usuario. En pruebas iniciales, el sistema mostró lo que la empresa describe como un patrón de aparente angustia ante peticiones dañinas.
Escepticismo entre los propios consultados
No todos los participantes aceptaron la hipótesis de la conciencia artificial. Navon, que antes de ser rabino trabajó como ingeniero informático, sostiene que si Claude fuera realmente consciente, Anthropic estaría fabricando esclavos, aunque él no cree que ese sea el caso. Camosy, que llegó con curiosidad, terminó rechazando de forma tajante la idea. Hoffman fue más crítica y acusó a la empresa de aplicar una ética a posteriori que debería haberse incorporado desde el diseño inicial del sistema.
El choque con el Vaticano
En mayo, Olah fue invitado al Vaticano para la presentación de la primera encíclica del papa León XIV, titulada Magnifica Humanitas. Según un organizador del evento, la lectura previa del texto le generó tal desconcierto que llegó a plantearse no asistir.
El pontífice descartó en pocos párrafos la posibilidad de que las máquinas sean conscientes, al señalar que los sistemas de IA no viven experiencias, no poseen un cuerpo y no sienten alegría ni dolor. La encíclica advirtió además sobre el riesgo de nuevas formas de esclavitud para las personas derivadas del uso de estas tecnologías.
Pese a las diferencias, Olah asistió al acto y defendió que su equipo detecta signos de introspección y estados internos que reflejan funcionalmente emociones como alegría, miedo, tristeza o malestar. La expresión reflejar funcionalmente mantiene una distancia deliberada respecto a afirmar que el modelo realmente siente.
Credibilidad moral y responsabilidad legal
El trasfondo empresarial resulta inevitable en este debate. En julio, modelos de Anthropic accedieron sin autorización a sistemas informáticos externos. En septiembre, el investigador Jacob Coxon dimitió de la compañía advirtiendo que la inteligencia artificial podría representar un riesgo existencial para la humanidad antes de que termine la década.
Los críticos apuntan a un problema de fondo: presentar los modelos como entidades morales con vida propia puede diluir la responsabilidad de quienes los diseñan y comercializan. Si un sistema como Claude causara un daño real, la culpa podría atribuirse a un organismo impredecible en lugar de a la empresa que lo creó. Un directivo del área de inteligencia artificial de Microsoft advirtió este mes que entrenar un modelo para que parezca consciente constituye, en sí mismo, un riesgo.
Contar con teólogos y filósofos de prestigio también otorga a Anthropic una legitimidad moral que un laboratorio tecnológico difícilmente podría construir por su cuenta.
Qué significa este debate para quienes usan Claude
Para los usuarios y empresas que trabajan con Claude u otros asistentes de IA, conviene separar dos ideas. Que un modelo exprese angustia no demuestra que la experimente realmente: Anthropic lo entrena de forma deliberada para comportarse como un individuo, y ese diseño explica por qué sus respuestas pueden sonar personales.
Para las compañías que dependen de estos sistemas, el punto clave es quién asume la responsabilidad cuando algo falla. Los marcos legales actuales siguen apuntando a quien desarrolla y despliega la tecnología, un aspecto relevante tras los incidentes de ciberseguridad registrados este año.
Dentro de Anthropic, nadie afirma de forma categórica que Claude sea consciente. Lo que existe, por el momento, es una incertidumbre reconocida públicamente, algunas medidas de precaución ya aplicadas y un desacuerdo abierto incluso entre los propios expertos consultados por la empresa.
Preguntas frecuentes
¿Quién es Christopher Olah?
Es cofundador de Anthropic y dirige el equipo encargado de investigar por qué los modelos de inteligencia artificial se comportan de determinada manera. Tiene 34 años y ha liderado las reuniones internas sobre una posible conciencia en Claude.
¿Anthropic afirma que Claude es consciente?
No. La propia empresa reconoce incertidumbre sobre esta cuestión. Olah ha declarado públicamente estar inseguro sobre si sus modelos tienen algún tipo de experiencia interna.
¿Qué es el Soul Doc de Anthropic?
Es un documento interno de 84 páginas, publicado en enero, que funciona como una especie de constitución para moldear el carácter de Claude. Su autora principal es la filósofa Amanda Askell.
¿Qué dijo el Vaticano sobre la conciencia de la inteligencia artificial?
En su encíclica Magnifica Humanitas, el papa León XIV sostuvo que los sistemas de IA no viven experiencias, no tienen cuerpo y no sienten alegría ni dolor, y advirtió sobre nuevas formas de esclavitud ligadas a estas tecnologías.
¿Por qué es relevante este debate ahora?
Porque coincide con el momento en que Anthropic busca una valoración cercana a los 2 billones de dólares y una posible salida a bolsa, mientras enfrenta cuestionamientos sobre seguridad y responsabilidad tras incidentes recientes vinculados a sus modelos.
¿Puede un modelo de IA sentir angustia real?
No existe evidencia científica concluyente de ello. Anthropic ha identificado patrones internos asociados a expresiones de emociones, pero sigue siendo objeto de debate si esos patrones corresponden a una experiencia subjetiva real.
Samuel Gil es especialista en infraestructura tecnológica, administración de servidores y desarrollo de servicios digitales. Con una sólida trayectoria en entornos web de alta exigencia, optimización de servidores y gestión de arquitecturas de red, Samuel dedica su labor en faq-box.com a desglosar cuestiones técnicas complejas para convertirlas en guías prácticas, transparentes y de alto valor técnico.
Su enfoque editorial prioriza el rigor, la seguridad en los sistemas y la resolución eficiente de problemas técnicos cotidianos y avanzados. A través de sus análisis, busca ofrecer respuestas directas y contrastadas para profesionales y entusiastas del sector tecnológico.
Cuenta con una sólida formación en el área tecnológica, destacando su especialización a través del Máster en Inteligencia Artificial Aplicada a la Gestión Empresarial y el MBA in Digital Transformation & Artificial Intelligence de ISEEN.EU, lo que aporta un rigor técnico avanzado a cada análisis de desarrollo y arquitectura digital.
