Storia
settembre 19, 2026

Il piano di sicurezza da 1 miliardo di dollari di Anthropic affronta una prova di indipendenza

Anthropic presenta la valutazione integrata come un modo pratico per verificare se le aziende di IA di frontiera mantengano i propri impegni di sicurezza; gli scettici sostengono che inserire una grande società di consulenza nel libro paga dell'azienda renda l'indipendenza la questione centrale ancora senza risposta.

Anthropic ha portato il suo modello proposto di supervisione dell'IA di frontiera dalla teoria verso un esperimento reale, nominando Accenture come suo primo valutatore integrato. L'azienda e la società di consulenza prevedono entrambe di investire almeno 1 miliardo di dollari in cinque anni per sviluppare capacità di valutazione, con Faculty, l'attività specializzata di Accenture nell'IA, alla guida del lavoro.

L'accordo è concepito per andare oltre le convenzionali revisioni esterne. Anthropic afferma che i valutatori integrati lavoreranno all'interno delle aziende di IA con un accesso paragonabile a quello dei dipendenti: osservando lo sviluppo dei modelli durante l'addestramento, monitorando le decisioni durante la distribuzione, parlando direttamente con il personale e valutando se gli impegni di sicurezza vengano rispettati. Si prevede che Accenture sottoponga i modelli a red teaming, conduca valutazioni dell'allineamento e testi le misure di salvaguardia, mettendo al contempo a disposizione la propria esperienza su come imprese e governi utilizzano l'IA.

La tesi di Anthropic è che la vicinanza possa rafforzare il controllo anziché attenuarlo. «I valutatori integrati indipendenti non riducono la nostra responsabilità, ma contribuiscono a renderla più verificabile», ha affermato, sottolineando al contempo che la responsabilità finale della sicurezza dei modelli resta di Anthropic.

Ma l'annuncio mette anche in luce i punti deboli di questo modello di supervisione emergente. Non esistono standard consolidati per l'accesso, la rendicontazione o il finanziamento di un valutatore, e Anthropic finanzierà direttamente il lavoro di Accenture perché non esistono ancora finanziamenti comuni o sostenuti dal governo. L'azienda afferma di essere in contatto con METR e altri valutatori senza scopo di lucro, di sperare di collaborare alla fine con diversi gruppi e definisce non esclusiva la partnership con Accenture.

La risposta scettica si concentra in un'unica domanda incisiva: «Il primo valutatore integrato di Anthropic è ... Accenture?» Questa formulazione non contesta la necessità di test rigorosi. Mette in discussione se una società di consulenza pagata dal laboratorio che sta esaminando possa offrire l'indipendenza promessa dall'esperimento. Le prossime scelte di Anthropic sui valutatori — e le regole che disciplinano ciò che Accenture può divulgare — determineranno se questo diventerà un modello credibile per la sicurezza o una forma sofisticata di autosupervisione.