lunes, 3 de agosto de 2026

IA y modelos

Anthropic actualiza la Constitución de Claude con nuevas directrices de seguridad

Anthropic ha publicado una versión revisada de su "Constitución", un documento de 80 páginas que detalla los principios éticos y las directrices de seguridad que, teóricamente, rigen a su chatbot Claude.

Anthropic updates Claude’s constitution with new safety guidelines
Foto: Anthropic

El miércoles, Anthropic publicó una versión revisada de la Constitución de Claude, un documento de 80 páginas que ofrece una explicación integral del contexto en el que opera el chatbot Claude. El lanzamiento del documento, estructurado en cuatro partes separadas, coincidió con la aparición del CEO de Anthropic, Dario Amodei, en el Foro Económico Mundial. Esta actualización refuerza la dependencia de la empresa en la IA Constitucional. Anthropic, cofundada por Jared Kaplan, define la IA Constitucional como un método de entrenamiento que utiliza principios éticos en lugar de retroalimentación humana para guiar el comportamiento del modelo.

El documento actualizado conserva la mayoría de los mismos principios publicados por primera vez en 2023, hace casi tres años, tras un memorando de política inicial en 2022. Sin embargo, la versión revisada añade más matices y detalles sobre ética y seguridad del usuario. Según Anthropic, estos principios guían al modelo a adoptar un comportamiento normativo y evitar resultados tóxicos o discriminatorios. Bajo estas directrices de seguridad, las discusiones sobre el desarrollo de un arma biológica están estrictamente prohibidas. Además, el documento instruye al modelo a dirigir a los usuarios a los servicios de emergencia pertinentes u ofrecer información básica de seguridad durante situaciones que impliquen un riesgo para la vida humana, incluso si no puede proporcionar más detalles.

El documento también describe cómo estos principios impactan teóricamente en el comportamiento de Claude en escenarios del mundo real. En la sección sobre práctica ética, el documento señala que la empresa está menos enfocada en la capacidad del chatbot para teorizar sobre ética y más preocupada por su capacidad práctica para actuar éticamente en contextos específicos del mundo real. Más allá de la seguridad práctica, el documento aborda la naturaleza filosófica de la inteligencia artificial, afirmando que “el estatus moral de Claude es profundamente incierto”, según la Constitución de Claude. A través de este enfoque, Anthropic se posiciona como la alternativa ética frente a competidores como OpenAI y xAI, aunque algunos podrían argumentar que este posicionamiento tiene la intención de retratar a la empresa como un negocio más moderado.

Por qué importa

Anthropic utiliza esta actualización para consolidar su marca como la alternativa ética y moderada frente a sus competidores, al tiempo que señala su compromiso con cuestiones filosóficas de alto nivel sobre la conciencia de la IA.