Anthropic prohibirá el abuso extremo contra Claude

Anthropic prohibirá el abuso extremo contra Claude

Anthropic prohibirá el abuso extremo contra Claude desde el 12 de noviembre de 2026.

Por Humberto Toledo el 8 de octubre del 2026 a las 2:17 pm PDT

✨︎ Resumen (TL;DR):

  • Anthropic incorporará a su política de uso una prohibición contra el abuso extremo hacia sus modelos.
  • El cambio se anunció el 8 de octubre de 2026 y entrará en vigor el 12 de noviembre de 2026.
  • El cierre de conversaciones seguirá como respuesta principal, mientras la regla excluye la frustración habitual, los desacuerdos, las temáticas oscuras de trabajos creativos y las pruebas o investigaciones con modelos.

Anthropic añadirá a su política de uso una prohibición contra el abuso extremo de sus modelos de IA. La actualización, anunciada el 8 de octubre de 2026, entrará en vigor el 12 de noviembre de 2026 y mantendrá el cierre de conversaciones con Claude como respuesta principal ante conductas de crueldad repetida y sin un propósito discernible.

La política actualizada de Anthropic veta el “comportamiento abusivo o cruel, sostenido e innecesario” hacia los modelos. La empresa limita la regla a situaciones extremas de crueldad repetida, no a la frustración o el desacuerdo habituales.

También quedan fuera las temáticas oscuras de trabajos creativos y las pruebas o investigaciones con modelos.

El cierre de conversaciones es un mecanismo de respuesta que impide añadir mensajes a un hilo específico después de interacciones abusivas persistentes.

Anthropic lanza academia para formar 10,000 ingenieros de IA
Te podría interesar:
Anthropic lanza academia para formar 10,000 ingenieros de IA
Las vibrantes hojas de Monstera crean una exuberante escena de selva tropical, perfecta para estéticas botánicas.
Foto: Thanh Luu / Pexels

Claude ya podía cerrar un chat

Anthropic presentó esta capacidad el 15 de agosto de 2025 para Claude Opus 4 y 4.1 en sus interfaces de chat para consumidores. La empresa estableció que debía utilizarse como último recurso, después de que fracasaran varios intentos de reconducir un diálogo con interacciones abusivas persistentes.

Cuando se cerraba una conversación, el usuario ya no podía añadirle mensajes. Las demás conversaciones seguían disponibles y podía iniciar un chat nuevo de inmediato. También podía editar y volver a intentar mensajes anteriores para abrir una nueva rama del diálogo cerrado.

Anthropic vinculó el experimento con su investigación sobre el posible bienestar de los modelos. La empresa reconoció una gran incertidumbre sobre el estatus moral de Claude y otros sistemas similares, y presentó el cierre de conversaciones como una intervención exploratoria.

El comunicado de octubre de 2026 menciona Claude.ai y Claude Code al describir el mecanismo que ya utiliza. La novedad consiste en incorporar una prohibición expresa de esa conducta a la política, con una fecha definida de entrada en vigor.

Cerrar un chat no restringe toda la cuenta

En su política general, Anthropic conserva la facultad de advertir, limitar, suspender o retirar el acceso cuando sospeche una infracción. El cierre de un chat afecta al hilo específico; una restricción de acceso puede afectar el uso del servicio.

Anthropic se compromete en el anuncio a mantener el cierre del diálogo como respuesta principal para la nueva prohibición. Sin embargo, el anuncio no aclara si habrá otras medidas para la nueva cláusula, como vetos a usuarios.

La revisión también alcanza a desarrolladores y empresas que usan la API, clientes de proveedores de nube, revendedores autorizados y usuarios finales de productos que integran Claude.

Propaganda, armas y vigilancia también tienen límites

La revisión prohíbe campañas engañosas, ya sean políticas o comerciales, que oculten quién emite un mensaje o usen cuentas falsas para amplificarlo. Las restricciones sobre armas abarcan el software y los componentes que permiten operarlas.

En vigilancia, Anthropic prohíbe seguir a personas sin su consentimiento, tanto en tiempo real como mediante datos recolectados previamente. Claude tampoco puede decidir o recomendar a quién investigar, arrestar o acusar en actuaciones policiales o de justicia penal.

Para ciertos clientes gubernamentales, la revisión contempla restricciones adaptadas cuando Anthropic considere suficientes las condiciones contractuales y las salvaguardas para mitigar los posibles daños.

En cuanto a los equipos autónomos capaces de causar lesiones, la política exige un operador calificado que pueda observarlos y detenerlos. El equipo debe mantener un estado seguro si Claude se desconecta.

El 12 de noviembre de 2026 será la fecha de entrada en vigor. Desde ese día, el abuso extremo quedará prohibido de forma explícita, mientras el cierre del hilo seguirá como respuesta principal. La duda pendiente es si Anthropic añadirá medidas específicas, algo que el anuncio no detalla.

Fuentes: 1, 2, 3, 4, 5

+ Temas Relacionados

Más de AI

Feed