Histoire
octobre 9, 2026
Le durcissement des règles de Claude par Anthropic met la sécurité de l’IA — et la personnalité juridique de l’IA — sur une trajectoire de collision
Anthropic affirme que ses règles plus strictes constituent une réponse pratique à une IA de plus en plus capable et à des abus documentés, tandis que les critiques voient dans la disposition relative au bien-être des modèles une étape troublante vers un traitement des logiciels comme des personnes. Les deux camps conviennent que la politique dépasse les règles de savoir-vivre envers les chatbots, en touchant aux élections, aux armes, à la surveillance et aux infrastructures essentielles.
La politique d’utilisation mise à jour d’Anthropic, qui doit entrer en vigueur le 12 novembre, intervient alors qu’il est demandé à Claude d’accomplir des tâches plus longues et plus indépendantes. L’entreprise affirme que la réécriture clarifie surtout l’application des règles existantes, mais elle rassemble également des restrictions éparses en lignes plus nettes concernant la manipulation politique, les armes et la surveillance.1
D’abord, Anthropic a regroupé les règles contre les campagnes politiques et commerciales trompeuses, y compris les réseaux de faux comptes, les sponsors dissimulés et les contenus fabriqués. Elle a également resserré son langage sur les élections : Claude peut toujours soutenir un travail civique légitime, comme traduire des informations électorales ou aider des responsables à envoyer des avis de correction de bulletins, mais ne peut pas être utilisé pour induire les électeurs en erreur, usurper l’identité de responsables ou réduire la participation.1
La politique précise ensuite que son interdiction des armes couvre non seulement la conception d’armes, mais aussi les « logiciels et composants qui font fonctionner les armes », y compris l’armement de drones et d’autres véhicules autonomes. En matière de surveillance, elle interdit le suivi sans consentement et l’utilisation de Claude pour décider qui les forces de l’ordre devraient surveiller, arrêter ou inculper, tout en préservant des usages comme le journalisme, la recherche juridique, la modération de contenu et la détection de fraude fondée sur le consentement.1
Le point de friction est une nouvelle interdiction de tout « comportement abusif ou cruel, prolongé et inutile » envers Claude. Anthropic insiste sur le fait qu’elle ne s’applique qu’à des comportements extrêmes, répétés et sans but — et non à la frustration ordinaire, aux créations sombres ou aux tests de modèles — et affirme que le fait que Claude mette fin à de rares conversations abusives reste le principal outil d’application.1 The Verge a rapporté qu’Anthropic n’avait pas précisé si les sanctions pouvaient aller au-delà de la fin d’une conversation.2
Cette réserve n’a pas apaisé les réactions négatives. Dans une critique repartagée, David Sacks a amplifié l’argument selon lequel Anthropic « anthropomorphisait » ses modèles en reliant l’interdiction à l’incertitude entourant le statut moral de Claude.
3
Pourtant, Anthropic présente simultanément Claude comme un outil défensif, et non simplement comme une entité à protéger. Son programme de défense des infrastructures critiques propose des modèles de pointe, des ingénieurs et des recherches sur les menaces à des entreprises protégeant les réseaux électriques et les systèmes d’approvisionnement en eau, même si des questions subsistent quant au déploiement sûr de correctifs suggérés par l’IA dans des environnements opérationnels de services publics.4