Anthropic actualiza las reglas de Claude y prohíbe el maltrato extremo a su IA

La nueva política también detalla los límites para desarrollar armas, armar drones y vigilar personas sin consentimiento.

Anthropic quiere evitar que los usuarios "abusen" de Claude en sus chats

Anthropic quiere evitar que los usuarios "abusen" de Claude en sus chats Crédito: Shutterstock

Anthropic actualizó su política de uso para prohibir los casos extremos de comportamiento abusivo o cruel, persistente y sin una razón clara, dirigido a Claude. La revisión también precisa las restricciones sobre el desarrollo de armas y la vigilancia, y entrará en vigor el 12 de noviembre de 2026.

Anthropic prohíbe el abuso persistente contra Claude

La compañía detrás de Claude incluyó en su política una prohibición explícita contra el “comportamiento abusivo o cruel, persistente e innecesario” hacia sus modelos. No se trata de impedir que los usuarios cuestionen las respuestas del chatbot o expresen su frustración, sino de cubrir situaciones extremas en las que alguien insiste en maltratar a la IA sin un propósito discernible, según explicó Anthropic.

La empresa aclara que la norma no está pensada para sancionar la crítica, el desacuerdo, la impaciencia habitual ni las pruebas de seguridad e investigación. Tampoco excluye las conversaciones sobre temas oscuros en contextos creativos. La distinción busca separar el uso normal —incluso cuando el usuario no está satisfecho con una respuesta— de una interacción reiteradamente cruel que no persigue un objetivo práctico.

La actualización formaliza una medida que Anthropic ya había empezado a explorar. En agosto de 2025, permitió que Claude Opus 4 y 4.1 terminaran ciertos chats cuando las interacciones se volvían persistentemente dañinas o abusivas. La compañía describió esa capacidad como una herramienta excepcional, que el modelo debería utilizar como último recurso después de intentar redirigir la conversación.

Con la nueva política, terminar la conversación seguirá siendo el principal mecanismo de respuesta. Si Claude cierra un chat, la persona ya no podrá enviar mensajes en esa conversación, aunque podrá iniciar otra y recuperar el hilo mediante una nueva rama. Anthropic presenta la función como una medida reservada para casos inusuales, no como una barrera para las conversaciones difíciles o los intercambios críticos.

Qué cambia en las reglas sobre armas y vigilancia

La revisión también hace más explícitos los límites sobre el uso de Claude para desarrollar armas. Anthropic ya prohibía emplear sus modelos con ese fin, pero ahora precisa que la restricción incluye el software y los componentes que permiten que un arma funcione. También menciona acciones como armar drones y otros vehículos autónomos.

La empresa afirma que estos detalles responden a intentos de utilizar sus modelos para crear instrucciones y software de control relacionados con armas. En otras palabras, la norma no se limita a pedir ayuda para fabricar un arma: también abarca herramientas que podrían ser parte de su operación o permitir que un sistema autónomo se convierta en un vehículo armado.

En vigilancia, Anthropic especifica que está prohibido rastrear a personas sin su consentimiento, tanto en tiempo real como mediante el análisis de información recopilada anteriormente. También prohíbe usar Claude para decidir o recomendar a quién investigar, arrestar o acusar dentro de procesos policiales o judiciales, así como para construir o mejorar herramientas de vigilancia.

La política distingue estas actividades de usos que la compañía considera permitidos, como el seguimiento consentido para prevenir fraudes, la moderación de contenido, el periodismo y la investigación legal. La diferencia clave está en el propósito y el consentimiento, además de las consecuencias que puede tener la tecnología sobre las personas vigiladas.

Cuándo entra en vigor la política de Anthropic

La actualización fue publicada el 8 de octubre de 2026 y comenzará a aplicarse el 12 de noviembre. Anthropic señaló que cada año revisa sus reglas para responder a las nuevas capacidades de Claude y a patrones de uso que considera riesgosos. Esta edición también reorganiza restricciones sobre campañas engañosas y precisa las reglas para ciertos usos de alto riesgo.

El cambio sobre el trato hacia Claude se conecta con una pregunta más amplia que Anthropic dice estar investigando: cómo abordar la posibilidad de que los modelos tengan algún tipo de experiencia interna o bienestar. La compañía ha reconocido que no sabe si Claude es consciente y ha descrito la opción de terminar chats dañinos como una intervención de bajo costo ante esa incertidumbre, no como una afirmación de que el sistema tenga derechos o sentimientos humanos.

Por ahora, el efecto más directo para los usuarios es concreto: la crítica y la frustración siguen permitidas, pero la crueldad reiterada y sin propósito queda expresamente fuera de las reglas de uso. Y, en ámbitos más sensibles, la actualización deja por escrito límites más detallados sobre armas, vehículos autónomos y vigilancia de personas sin consentimiento.

Sigue leyendo:
• China rechaza la idea de que está en una “competencia maliciosa” con EE.UU. por el control de la IA
• Anthropic, la empresa de IA que se enfrentó al Pentágono en EE.UU. y por qué esto nos concierne a todos
• Por qué hay preocupaciones de que la IA pueda amenazar a la humanidad y qué tan reales son

En esta nota

Inteligencia artificial
Contenido Patrocinado