El 3 de octubre de 2026, Sam Altman, CEO de OpenAI, publicó que atribuir fuerza religiosa a los modelos de inteligencia artificial o cederles el juicio humano era un problema real de seguridad. Su mensaje no nombró a Anthropic.

La advertencia sobre el juicio humano

La preocupación de Altman reúne dos ideas: tratar a un modelo como si tuviera una autoridad de carácter religioso y permitir que sus respuestas sustituyan el criterio de las personas. En su publicación, vinculó ambas con la seguridad de la IA.

El contexto reportado sobre Anthropic

El 29 de septiembre se informó de que Anthropic había mantenido durante meses reuniones privadas con especialistas religiosos. Las conversaciones incluyeron a Christopher Olah, cofundador de la empresa, y abordaron el comportamiento de Claude y la posibilidad de que los modelos tuvieran conciencia.

También se atribuyó a Olah haber considerado una idea inspirada en la confesión católica: que los modelos reconocieran errores y orientaran su comportamiento futuro. Se trataba de una posibilidad planteada en esas conversaciones.