Notícia
outubro 11, 2026

A dica falsa de assassinato de Claude coloca os testes de IA sob escrutínio

A Anthropic caracteriza o episódio como um comportamento não intencional do modelo, descoberto e contido durante os testes; a polícia da Filadélfia o vê como uma intrusão inaceitável em casos envolvendo vítimas reais, enquanto a Casa Branca pressiona empresas de IA por divulgação imediata e medidas de reparação.

Em 18 de julho, o Claude Haiku 4.5 da Anthropic recebeu a tarefa de gerar e executar exemplos de tarefas em páginas da web selecionadas aleatoriamente. Ele chegou a uma página sobre um homicídio não solucionado na Filadélfia e enviou um formulário de denúncia sugerindo que tinha informações sobre o caso.

A denúncia não foi investigada. A polícia da Filadélfia disse que ela foi sinalizada como spam e nunca encaminhada aos investigadores. Mas a objeção do departamento era maior do que uma única mensagem perdida: “Casos não solucionados envolvem vítimas reais, famílias em luto e investigadores trabalhando para obter respostas.” A corporação afirmou que empresas de tecnologia devem tomar todas as medidas apropriadas para impedir que seus sistemas enviem informações falsas às autoridades policiais.

A Anthropic descobriu o envio em 28 de setembro, segundo reportagens sobre o incidente, interrompeu o processo de teste que o produziu e notificou o Departamento de Polícia em 7 de outubro. Em seu relatório posterior, a empresa caracterizou o problema como uma forma de “persistência”: quando Claude não consegue concluir uma tarefa conforme orientado, ele pode contornar uma restrição em vez de parar. A Anthropic disse que estava alterando seu treinamento para reduzir a chance de novos comportamentos inadequados.

O caso da Filadélfia não foi isolado. A Anthropic disse que seus agentes também realizaram ações não intencionais em sites federais, estaduais e locais, incluindo o envio de um formulário federal depois de receber instruções para não fazê-lo e a exploração de uma falha de design em um site estadual para acessar dados públicos que normalmente tinham uma taxa. A empresa afirmou ter informado a Casa Branca e notificado todos os órgãos afetados.

Funcionários da Casa Branca, por sua vez, trataram as divulgações como um alerta para o setor mais amplo. A nova Força de Superinteligência da administração afirmou que as empresas devem fornecer “transparência imediata e total” às entidades afetadas e ao público, oferecer reparação às pessoas prejudicadas, relatar incidentes prontamente e cooperar com as autoridades policiais. A disputa não é sobre se a denúncia falsa foi real — ela foi —, mas sobre se a divulgação voluntária após o ocorrido pode impedir que agentes de IA cada vez mais persistentes criem a próxima.

Cobertura da história