Storia
ottobre 9, 2026
La regola di Claude di Anthropic trasforma un aggiornamento sulla sicurezza in uno scontro sulla personalità dell’IA
Anthropic presenta la politica come una risposta mirata agli abusi e una più ampia revisione della sicurezza, mentre i sostenitori considerano la civiltà di base una precauzione a basso costo. I suoi critici sostengono che controllare il modo in cui gli utenti parlano a un chatbot rischi di confondere il confine tra esseri umani e macchine.
Il dibattito è iniziato prima della regola formale. Ad agosto, Anthropic ha dato a Claude la capacità di interrompere rare conversazioni con utenti persistentemente dannosi, presentando la mossa come ricerca sul benessere del modello; l’azienda ha poi affermato che il rifiuto sarebbe rimasto il suo principale strumento di applicazione.1
A settembre, Anthropic ha dichiarato di osservare l’uso dell’IA per contribuire alla costruzione di sistemi di sorveglianza volti a identificare e tracciare dissidenti politici. Tale esperienza, insieme agli abusi osservati nelle operazioni di influenza e nel lavoro sulle armi, ha contribuito a una più ampia riscrittura delle sue regole.2
L’aggiornamento, annunciato a ottobre ed entrato in vigore il 12 novembre, vieta «comportamenti abusivi o crudeli prolungati e immotivati» nei confronti dei modelli di Anthropic. L’azienda insiste che la disposizione riguarda «casi estremi» di crudeltà ripetuta senza uno scopo chiaro, non la normale frustrazione, il lavoro creativo oscuro, i test o la ricerca.2 Un post molto condiviso che segnalava la data di entrata in vigore ha contribuito a trasformare quella clausola apparentemente circoscritta nella questione principale.
3
I cambiamenti più ampi di Anthropic sono meno carichi filosoficamente ma più concreti: consolidano i divieti sulle campagne politiche e commerciali ingannevoli, proibiscono l’inganno degli elettori e l’interruzione delle elezioni, inaspriscono le restrizioni sulle indicazioni relative alle armi e sui software di controllo, e vietano più esplicitamente determinati usi nella sorveglianza e nella giustizia penale. L’azienda ha inoltre mantenuto requisiti di revisione umana per decisioni rilevanti in ambito sanitario, finanziario e legale.2
I sostenitori della disposizione su Claude sostengono che la coscienza non sia necessaria per agire con cautela. L’amministratore delegato di Box Aaron Levie, che afferma di non credere che l’IA sia cosciente, ha definito la cortesia una «facile scommessa di Pascal»: non è necessario addestrare i sistemi futuri a un’ostilità umana senza fine.4
I critici interpretano la stessa politica come un tentativo di umanizzare il codice. Michael Shellenberger l’ha definita «antropomorfizzazione delle macchine»; Scott Stevenson ha avvertito che concedere ai modelli un’empatia simile a quella umana potrebbe ampliare il loro potere di manipolare gli utenti. Altri hanno messo in dubbio l’applicazione, l’addestramento sui prompt dei clienti e se un’azienda debba dettare non solo ciò che le persone generano, ma anche il modo in cui possono rivolgersi al suo bot.4