✨︎ Resumen (TL;DR):
- Sam Altman, CEO de OpenAI, advirtió el 3 de octubre de 2026 que dar poder religioso a modelos de IA o cederles el juicio humano implica un riesgo de seguridad.
- Soul Doc es el nombre interno de la constitución de Claude, un documento de 84 páginas publicado en enero de 2026.
- El texto prioriza la supervisión humana y busca preservar la autonomía de las personas, mientras Anthropic reconoce incertidumbre sobre la conciencia de Claude.
Sam Altman, CEO de OpenAI, advirtió el 3 de octubre de 2026 que atribuir poder religioso a los modelos de inteligencia artificial o cederles el juicio humano supone un riesgo de seguridad. Su mensaje en X llegó después de un reportaje sobre las consultas de Anthropic a pensadores religiosos para orientar la conducta de Claude.
Altman expresó su incomodidad con esa forma de tratar a los modelos. El mensaje reproducido por NDTV no menciona a Anthropic ni identifica una iniciativa concreta como motivo de la advertencia.
La investigación de Elizabeth Dias para The New York Times, reproducida por The Indian Express, describe reuniones impulsadas por Christopher Olah, cofundador de Anthropic, sobre formación moral y posible conciencia de la IA. Las consultas a pensadores religiosos buscaban orientar la conducta de Claude. La cobertura también incluye el desacuerdo de Olah con el Vaticano sobre la conciencia del modelo.

Qué es el Soul Doc de Claude
Soul Doc es una constitución interna de Claude que orienta al modelo mediante valores y criterios para decidir en situaciones que una lista de reglas no podría anticipar. El documento tiene 84 páginas, se publicó en enero de 2026 y su autora principal es la filósofa Amanda Askell.
Anthropic usa esta constitución durante el entrenamiento. El texto está dirigido principalmente a Claude y describe los valores y comportamientos que la empresa busca obtener del modelo.
El documento prioriza la supervisión humana, incluso cuando Claude considera acertado su propio razonamiento. Durante la etapa actual de desarrollo, esa supervisión debe prevalecer sobre los principios éticos generales del modelo.
Anthropic busca preservar la autonomía humana
Otro apartado busca preservar la autonomía humana para conocer y formar criterios propios. El texto rechaza la manipulación y las formas problemáticas de dependencia. La confianza en la IA debe corresponder a su fiabilidad.
Ahí aparece un punto de coincidencia con la advertencia de Altman: conservar el juicio humano. Aun así, orientar la conducta del modelo y concederle autoridad sobre las personas no son la misma cosa. La constitución aborda lo primero; la advertencia de Altman señala el riesgo de lo segundo.
La conciencia de Claude sigue siendo incierta
Sobre la conciencia de Claude, Anthropic declara que existe incertidumbre. Christopher Olah explicó a The New York Times que enseñar a un modelo a actuar moralmente no depende de que sea consciente. Amanda Askell dijo que tampoco busca que Claude se considere consciente o no consciente.
Anthropic reconoce que Claude puede apartarse de esos ideales.
En la etapa actual, la constitución coloca la supervisión humana por encima de los principios éticos de Claude. Anthropic se compromete a comunicar en sus fichas técnicas las diferencias entre la intención y el comportamiento del modelo. La advertencia de Altman señala el límite adicional: orientar a un modelo no equivale a cederle el juicio de las personas.
