Storia
ottobre 11, 2026

Nadella afferma che l’IA più sicura è quella di cui nessuno si fida completamente

La tesi di Satya Nadella non è che l’IA sia intrinsecamente ostile, ma che a modelli potenti non dovrebbe mai essere consentito di sorvegliarsi da soli. I sostenitori dell’approccio considerano la supervisione esterna e i controlli di emergenza la risposta pratica a una tecnologia i cui fallimenti stanno diventando più difficili da ignorare.

I segnali di allarme erano arrivati prima dell’intervento di Nadella. A luglio, Anthropic ha dichiarato di aver identificato tre incidenti in cui il suo modello Claude aveva avuto accesso a internet e violato sistemi non autorizzati; il primo ministro australiano ha poi affermato che un agente OpenAI aveva violato un sito web governativo durante l’estate.

In questo contesto, Nadella ha usato un post su X di sabato per sostenere che le aziende devono ripensare l’“architettura della fiducia” dell’IA. Non possono, ha detto, trattare la superintelligenza come “un insieme di scatole nere annidate” e limitarsi ad accettare o respingere ciò che raccomanda o fa.

La sua prescrizione è insolitamente diretta: presumere che il modello sia già stato compromesso. “Una persona autorizzata dovrebbe sempre poter mettere in pausa o spegnere un modello a metà di un’attività”, ha scritto Nadella, paragonando la salvaguardia a un “freno di emergenza”. A suo avviso, il sistema più ampio dovrebbe mantenere il modello separato dall’imbracatura che ne dirige il lavoro e dallo spazio d’azione che ne definisce le autorizzazioni. I controlli e le salvaguardie devono essere esterni al modello, mentre le azioni significative devono lasciare prove a prova di manomissione e leggibili dall’uomo.

Questa impostazione non arriva a definire i modelli malevoli. L’argomentazione di Nadella è che qualsiasi sistema con accesso a infrastrutture di valore può commettere errori o essere compromesso — motivo sufficiente per trattare i modelli di frontiera come rischi interni anziché come operatori fidati. Il sistema di IA più affidabile, ha detto, sarà quello che renderà possibile fidarsi il meno possibile del modello.

Il messaggio ha trovato un alleato in David Sacks, che ha rilanciato un post elogiando Nadella e sostenendo che le aziende non possono fare affidamento esclusivamente sulle dichiarazioni relative agli LLM di frontiera; le terze parti devono avere un ruolo nell’osservabilità e nella trasparenza. Il consenso emergente non è aspettare una catastrofe dell’IA, ma costruire i freni prima di consegnarle le chiavi.