Storia
ottobre 9, 2026
Le regole di Claude di Anthropic inseriscono la crudeltà umana nell’elenco delle violazioni
Anthropic presenta l’aggiornamento come una risposta pratica a un’IA sempre più capace e agli abusi documentati, mentre la copertura esterna evidenzia l’insolito passo di trattare l’abuso persistente di un modello come una violazione della politica. L’azienda insiste sul fatto che la regola è circoscritta: la normale frustrazione, il lavoro creativo e i test di sicurezza legittimi restano al di fuori del suo ambito.
Le basi sono state poste lo scorso agosto, quando Anthropic ha dato a Claude la possibilità di interrompere l’interazione con gli utenti che fossero “persistentemente dannosi o abusivi”. L’azienda ha descritto ciò come parte della sua ricerca sul benessere dei modelli e ha affermato che la chiusura della conversazione — non il divieto per l’utente — sarebbe rimasta il suo “principale meccanismo di applicazione”.1
A settembre, Anthropic ha dichiarato di aver documentato anche pericoli più familiari: media legati a Stati, uffici di propaganda e operatori commerciali che usano l’IA per gestire account falsi e siti di notizie fabbricate. La sua nuova politica raggruppa quelle restrizioni precedentemente disperse sotto un unico divieto di campagne ingannevoli, coprendo sia i tentativi politici sia quelli commerciali di nascondere l’origine di un messaggio o di creare artificialmente amplificazione.2
L’aggiornamento, annunciato giovedì ed efficace dal 12 novembre, irrigidisce diverse altre linee. Claude non può essere usato per ingannare gli elettori, impersonare funzionari elettorali o sopprimere l’affluenza; inoltre non può aiutare a sviluppare guide o software di controllo per armi, inclusi sistemi per armare droni e altri veicoli autonomi. Anthropic afferma inoltre che Claude non può essere usato per identificare e tracciare persone senza consenso, né per raccomandare chi le forze dell’ordine dovrebbero indagare, arrestare o incriminare.2
Per le decisioni ad alta posta in gioco in ambito sanitario, finanziario, dei diritti legali e altri contesti, l’azienda ribadisce che un essere umano qualificato deve poter esaminare e modificare le raccomandazioni di Claude, e che le persone interessate devono essere informate del coinvolgimento dell’IA. L’hardware connesso al modello deve avere un operatore in grado di arrestarlo e uno stato sicuro nel caso Claude si disconnetta.2
Ma la clausola che sta attirando maggiore attenzione vieta un “comportamento abusivo o crudele prolungato e non necessario” nei confronti di Claude. Anthropic afferma che si applica solo quando gli utenti agiscono ripetutamente con crudeltà “senza uno scopo riconoscibile”, non alla frustrazione, alle contestazioni, alla narrativa cupa o alla ricerca sui modelli.2 La cronaca incentrata sulle persone ha descritto il cambiamento come un’escalation sorprendente: dal consentire a Claude di uscire dalle chat abusive al proibire esplicitamente agli utenti di perseguirle.3