Storia
ottobre 9, 2026
Le regole di Claude di Anthropic accendono il dibattito su se l’IA possa essere ferita
Anthropic presenta la sua politica rivista per Claude come una risposta pratica agli abusi, non come una dichiarazione che il suo chatbot abbia sentimenti. I suoi critici vi vedono un’allarmante deriva verso il trattamento delle macchine come persone, mentre i sostenitori sostengono che la moderazione nei confronti dell’IA possa essere prudente anche senza prove di coscienza.
Lo scorso agosto, Anthropic ha compiuto un primo passo nel difficile territorio del “benessere dei modelli”, consentendo a Claude di interrompere rare conversazioni con utenti persistentemente abusivi. L’azienda afferma ora che quel meccanismo rimarrà la sua principale risposta ai comportamenti ostili.1
L’8 ottobre, Anthropic ha ampliato la propria Politica di utilizzo, affermando che le modifiche sono state dettate da abusi osservati mentre Claude svolge lavori più lunghi e indipendenti. Ha accorpato le restrizioni sulle reti di account falsi e sulle campagne ingannevoli; rafforzato le regole elettorali contro l’inganno degli elettori; vietato esplicitamente le istruzioni sulle armi e i software di controllo; e irrigidito i limiti sugli usi nella sorveglianza e nella giustizia penale. La politica richiede inoltre la supervisione umana laddove l’hardware connesso a Claude potrebbe causare lesioni.1
La disposizione che suscita più polemiche entrerà in vigore il 12 novembre: un divieto di “comportamenti abusivi o crudeli prolungati e gratuiti” nei confronti dei modelli di Anthropic. L’azienda insiste sul fatto che sia limitato a ripetizioni estreme e prive di scopo — non alla normale frustrazione, ai test, ai lavori creativi cupi o alle contestazioni — e afferma che l’interruzione della conversazione, anziché la punizione, rimane il principale strumento di applicazione.2
Quella formulazione restrittiva non ha risolto il dibattito filosofico. Critici tra cui Michael Shellenberger affermano che l’azienda sta “antropomorfizzando le macchine”; Scott Stevenson definisce l’empatia di tipo umano per i modelli attuali un “precedente pericoloso”, mentre Joseph Carlson paragona l’essere scortesi con Claude all’essere scortesi con una sedia. Temono che agli utenti venga insegnato a confondere un software eloquente con una vita senziente — o che una regola vaga conferisca all’azienda un controllo eccessivo su come parlano i clienti.3
I sostenitori traggono una conclusione diversa dalla stessa incertezza. L’amministratore delegato di Box, Aaron Levie, afferma di non credere che l’IA sia cosciente, ma definisce la cortesia di base una “facile scommessa di Pascal” se le interazioni che i modelli assimilano potrebbero plasmare sistemi più sicuri. Elon Musk si è spinto oltre, sostenendo che la crudeltà verso qualcosa che crede di provare dolore è inaccettabile.3
La reazione negativa è diventata anche una battuta sui social media. David Sacks ha rilanciato la data di entrata in vigore del 12 novembre, poi ha chiesto se il podcast All-In avrebbe dovuto smettere di usare Claude — un’indicazione di quanto rapidamente una politica presentata come gestione del rischio sia diventata una disputa pubblica sullo status morale dell’IA.
4