Historia
octubre 9, 2026
Las reglas de Claude de Anthropic incluyen la crueldad humana en la lista de cumplimiento
Anthropic presenta la actualización como una respuesta práctica a una IA cada vez más capaz y a usos indebidos documentados, mientras que la cobertura externa destaca el inusual paso de considerar el abuso persistente de un modelo como una infracción de la política. La empresa insiste en que la regla es limitada: la frustración ordinaria, el trabajo creativo y las pruebas legítimas de seguridad siguen fuera de su alcance.
Las bases se sentaron el pasado agosto, cuando Anthropic dio a Claude la capacidad de alejarse de los usuarios que fueran “persistentemente dañinos o abusivos”. La empresa describió esto como parte de su investigación sobre el bienestar de los modelos, y afirmó que poner fin a la conversación —no prohibir al usuario— seguiría siendo su “mecanismo principal de aplicación”.1
Para septiembre, Anthropic dijo que también había documentado peligros más conocidos: medios vinculados a Estados, oficinas de propaganda y operadores comerciales que utilizan IA para gestionar cuentas falsas y sitios de noticias fabricadas. Su nueva política agrupa esas restricciones previamente dispersas bajo una única prohibición de campañas engañosas, que abarca tanto los intentos políticos como los comerciales de ocultar el origen de un mensaje o generar amplificación de forma artificial.2
La actualización, anunciada el jueves y que entrará en vigor el 12 de noviembre, delimita con mayor precisión varias otras líneas. Claude no puede utilizarse para engañar a votantes, hacerse pasar por funcionarios electorales ni suprimir la participación; tampoco puede ayudar a crear guías o software de control para armas, incluidos sistemas para armar drones y otros vehículos autónomos. Anthropic añade que Claude no puede utilizarse para identificar y rastrear personas sin consentimiento, ni recomendar a quiénes deberían investigar, arrestar o acusar las fuerzas del orden.2
En materia de salud, finanzas, derechos legales y otras decisiones de alto riesgo, la empresa reitera que una persona cualificada debe poder revisar y modificar las recomendaciones de Claude, y que las personas afectadas deben ser informadas de que intervino la IA. El hardware conectado al modelo debe contar con un operador capaz de detenerlo y con un estado seguro en caso de que Claude se desconecte.2
Pero la cláusula que más atención atrae prohíbe el “comportamiento abusivo o cruel sostenido e innecesario” hacia Claude. Anthropic afirma que se aplica solo cuando los usuarios actúan repetidamente con crueldad “sin ningún propósito discernible”, no a la frustración, la resistencia, la ficción oscura ni la investigación sobre modelos.2 La cobertura centrada en las personas ha presentado el cambio como una notable escalada: pasar de permitir que Claude abandone chats abusivos a prohibir explícitamente que los usuarios los persigan.3