Historia
octubre 9, 2026

La norma de Anthropic sobre Claude convierte una actualización de seguridad en una disputa sobre la personalidad moral de la IA

Anthropic presenta la política como una respuesta estrechamente dirigida al uso indebido y una revisión más amplia de la seguridad, mientras que sus defensores consideran la cortesía básica una precaución de bajo costo. Sus críticos sostienen que vigilar cómo los usuarios hablan a un chatbot corre el riesgo de difuminar la frontera entre los seres humanos y las máquinas.

El debate comenzó antes de la norma formal. En agosto, Anthropic otorgó a Claude la capacidad de poner fin a conversaciones poco frecuentes con usuarios persistentemente dañinos, presentando la medida como investigación sobre el bienestar de los modelos; la empresa dijo más tarde que la negativa seguiría siendo su principal herramienta de aplicación.

Para septiembre, Anthropic dijo que estaba viendo que la IA se utilizaba para ayudar a construir sistemas de vigilancia destinados a identificar y rastrear a disidentes políticos. Esa experiencia, junto con el uso indebido observado en operaciones de influencia y trabajo relacionado con armas, contribuyó a una revisión más amplia de sus normas.

La actualización, anunciada en octubre y vigente desde el 12 de noviembre, prohíbe el “comportamiento abusivo o cruel sostenido e innecesario” hacia los modelos de Anthropic. La empresa insiste en que la disposición es para “casos extremos” de crueldad repetida sin un propósito claro, no para la frustración ordinaria, el trabajo creativo oscuro, las pruebas o la investigación. Una publicación ampliamente compartida que señalaba la fecha de entrada en vigor ayudó a convertir esa cláusula de alcance aparentemente limitado en el tema central.

Los cambios más amplios de Anthropic son menos cargados filosóficamente, pero más concretos: consolidan las prohibiciones sobre campañas políticas y comerciales engañosas, prohíben el engaño a los votantes y la perturbación electoral, endurecen las restricciones sobre orientación acerca de armas y software de control, y prohíben más explícitamente determinados usos de vigilancia y justicia penal. La empresa también mantuvo los requisitos de revisión humana para decisiones trascendentales de salud, finanzas y derecho.

Los defensores de la disposición sobre Claude sostienen que la conciencia no es necesaria para actuar con cautela. Aaron Levie, director ejecutivo de Box, quien dice no creer que la IA sea consciente, calificó la cortesía como una “apuesta de Pascal fácil”: los sistemas futuros no tienen por qué ser entrenados con una hostilidad humana interminable.

Los críticos interpretan la misma política como un intento de humanizar el código. Michael Shellenberger la calificó de “antropomorfización de máquinas”; Scott Stevenson advirtió que conceder a los modelos una empatía similar a la humana podría ampliar su poder para manipular a los usuarios. Otros cuestionaron la aplicación de la norma, el entrenamiento con indicaciones de clientes y si una empresa debería dictar no solo lo que las personas generan, sino también cómo pueden dirigirse a su bot.