Notícia
outubro 9, 2026
A regra da Claude da Anthropic transforma uma atualização de segurança em uma disputa sobre a personalidade da IA
A Anthropic apresenta a política como uma resposta estreitamente direcionada ao uso indevido e uma reformulação mais ampla de segurança, enquanto seus defensores veem a civilidade básica como uma precaução de baixo custo. Seus críticos argumentam que policiar a forma como os usuários falam com um chatbot corre o risco de confundir a fronteira entre seres humanos e máquinas.
O debate começou antes da regra formal. Em agosto, a Anthropic deu à Claude a capacidade de encerrar conversas raras com usuários persistentemente nocivos, apresentando a medida como pesquisa sobre o bem-estar do modelo; posteriormente, a empresa afirmou que a recusa continuaria sendo sua principal ferramenta de aplicação.1
Em setembro, a Anthropic disse estar vendo IA ser usada para ajudar a construir sistemas de vigilância voltados à identificação e ao rastreamento de dissidentes políticos. Essa experiência, juntamente com o uso indevido observado em operações de influência e no trabalho com armas, contribuiu para uma reformulação mais ampla de suas regras.2
A atualização, anunciada em outubro e em vigor a partir de 12 de novembro, proíbe “comportamento abusivo ou cruel, prolongado e desnecessário” em relação aos modelos da Anthropic. A empresa insiste que a disposição se destina a “casos extremos” de crueldade repetida sem objetivo claro — não à frustração comum, ao trabalho criativo sombrio, a testes ou à pesquisa.2 Uma publicação amplamente compartilhada que assinalava a data de entrada em vigor ajudou a transformar essa cláusula aparentemente restrita na questão principal.
3
As mudanças mais amplas da Anthropic são menos carregadas filosoficamente, mas mais concretas: elas consolidam proibições contra campanhas políticas e comerciais enganosas, proíbem o engano de eleitores e a perturbação de eleições, endurecem restrições sobre orientações relativas a armas e softwares de controle, e proíbem de forma mais explícita certos usos em vigilância e justiça criminal. A empresa também manteve exigências de revisão humana para decisões consequentes de saúde, finanças e direito.2
Os defensores da disposição sobre a Claude argumentam que a consciência não é necessária para a cautela. Aaron Levie, diretor-executivo da Box, que afirma não acreditar que a IA seja consciente, chamou a polidez de uma “aposta de Pascal fácil”: sistemas futuros não precisam ser treinados com hostilidade humana interminável.4
Críticos interpretam a mesma política como uma tentativa de humanizar código. Michael Shellenberger chamou-a de “antropomorfização de máquinas”; Scott Stevenson advertiu que conceder aos modelos empatia semelhante à humana poderia ampliar seu poder de manipular usuários. Outros questionaram a aplicação, o treinamento com prompts de clientes e se uma empresa deveria ditar não apenas o que as pessoas geram, mas como podem se dirigir ao seu bot.4