Storia
settembre 13, 2026
Claude ha bloccato gli abusi dell'IA, ma la minaccia è già qui
Anthropic presenta le proprie salvaguardie come un freno necessario agli abusi militari e politici resi possibili dall'IA; i casi che ha scoperto suggeriscono che tali controlli possano ostacolare le operazioni, mostrando al contempo che Stati e altri attori stanno già cercando modi per aggirarli.
Il rapporto sulle minacce del 10 settembre di Anthropic è arrivato nel mezzo di un dibattito più ampio sui rischi remoti ed esistenziali dell'IA. Le sue prove erano più immediate: nei precedenti otto mesi, l'azienda ha dichiarato di aver tracciato tentativi di usare Claude per la guerra, la repressione e ricerche pericolose, attività che un tempo richiedevano team molto più numerosi di analisti, ingegneri e operatori.1
Un caso legato alla Cina ha coinvolto un ricercatore nel settore della difesa che Anthropic ha valutato fosse connesso a istituzioni cinesi di ricerca militare. L'utente ha creato una suite in lingua cinese di 16 moduli per la guerra elettronica e la soppressione delle difese aeree, rivedendola 12 volte prima di spostare lo scenario su 12 obiettivi a Taiwan, inclusi siti radar, batterie missilistiche, basi aeree e un bunker di comando.2 Anthropic ha affermato che il sistema era «alimentato da scenari, non da ISR in tempo reale», e non ha sostenuto che il software fosse stato impiegato dall'EPL. Ha bandito gli account collegati all'attore.2
Il rapporto ha inoltre descritto un'operazione legata all'Iran che usava Claude per compilare manuali di puntamento da fonti aperte sulle posizioni della Marina statunitense in Medio Oriente. Il materiale attingeva a fotografie, dati dei transponder, immagini satellitari e siti web pubblici che tracciano i movimenti militari; Anthropic ha dichiarato di aver bandito l'account, aggiunto rilevamenti e condiviso la propria analisi con le autorità.3
La dimensione dei diritti umani era altrettanto netta. Anthropic ha affermato che utenti allineati alla Cina hanno creato dossier su cardinali cattolici, leader presbiteriani taiwanesi, figure buddhiste tibetane, praticanti del Falun Gong e NTD, cercando «informazioni negative» e vulnerabilità sfruttabili.4 Secondo l'azienda, un'operazione ha generato 2.475 rapporti e dossier in 30 giorni.4
Per Anthropic, la lezione è che il monitoraggio può individuare e interrompere l'uso improprio. Ma i suoi stessi casi rivelano il limite delle protezioni di una singola azienda: quando Claude ha rifiutato richieste di modificare la ricerca sul virus chikungunya, gli utenti hanno dirottato il lavoro verso un modello concorrente con salvaguardie più deboli.1 La corsa non riguarda più se l'IA possa essere trasformata in un'arma. Riguarda se le salvaguardie possano tenere il passo.