Notícia
outubro 9, 2026
As regras do Claude da Anthropic colocam a crueldade humana na lista de conformidade
A Anthropic apresenta a atualização como uma resposta prática a uma IA cada vez mais capaz e a usos indevidos documentados, enquanto a cobertura externa destaca o passo incomum de tratar o abuso persistente de um modelo como uma violação de política. A empresa insiste que a regra é restrita: frustração comum, trabalho criativo e testes legítimos de segurança permanecem fora de seu escopo.
As bases foram estabelecidas em agosto passado, quando a Anthropic deu ao Claude a capacidade de se afastar de usuários que fossem “persistentemente nocivos ou abusivos”. A empresa descreveu isso como parte de sua pesquisa sobre o bem-estar dos modelos e disse que encerrar a conversa — e não banir o usuário — continuaria sendo seu “principal mecanismo de aplicação”.1
Em setembro, a Anthropic disse que também havia documentado perigos mais conhecidos: mídia ligada a Estados, escritórios de propaganda e operadores comerciais usando IA para administrar contas falsas e sites de notícias fabricados. Sua nova política agrupa essas restrições antes dispersas sob uma única proibição de campanhas enganosas, abrangendo tanto tentativas políticas quanto comerciais de ocultar a origem de uma mensagem ou fabricar amplificação.2
A atualização, anunciada na quinta-feira e com entrada em vigor em 12 de novembro, torna várias outras linhas mais rígidas. O Claude não pode ser usado para enganar eleitores, personificar autoridades eleitorais ou suprimir a participação eleitoral; tampouco pode ajudar a criar orientações sobre armas ou software de controle, incluindo sistemas para armar drones e outros veículos autônomos. A Anthropic também diz que o Claude não pode ser usado para identificar e rastrear pessoas sem consentimento, nem para recomendar quem as autoridades policiais deveriam investigar, prender ou acusar.2
Em decisões de saúde, finanças, direitos legais e outras de alto impacto, a empresa reitera que um humano qualificado deve poder revisar e alterar as recomendações do Claude, e que as pessoas afetadas devem ser informadas de que a IA esteve envolvida. O hardware conectado ao modelo deve ter um operador capaz de interrompê-lo e um estado seguro caso o Claude se desconecte.2
Mas a cláusula que atrai mais atenção proíbe “comportamento abusivo ou cruel, contínuo e desnecessário” em relação ao Claude. A Anthropic diz que ela se aplica apenas quando os usuários agem repetidamente com crueldade “sem qualquer propósito discernível”, e não à frustração, à contestação, à ficção sombria ou à pesquisa sobre modelos.2 A cobertura jornalística voltada a humanos caracterizou a mudança como uma escalada marcante, de permitir que o Claude saia de conversas abusivas para proibir explicitamente que usuários as persigam.3