Storia
ottobre 1, 2026

Google afferma che Gemini 4 Argon è una svolta, ma il pubblico non può ancora testarlo

Google presenta Gemini 4 Argon come un ritorno alla frontiera dell’IA attento alla sicurezza, mentre la copertura esterna vede un modello dalle affermazioni formidabili ma con prove limitate disponibili per un esame indipendente. Il suo rilascio ristretto rende la cautela parte della proposta di Google—e il motivo centrale per cui le affermazioni restano non dimostrate.

Google aveva promesso un importante rilascio di modello per giugno, che secondo le aspettative diffuse sarebbe stato Gemini 3.5 Pro. Quel rilascio non è mai arrivato, dopo un periodo in cui l’azienda ha invece distribuito modelli Flash più piccoli mentre OpenAI e Anthropic avanzavano. Secondo alcune notizie, il ritardo è seguito a preoccupazioni interne riguardo alle prestazioni e al morale, aumentando la posta in gioco attorno al prossimo modello di punta di Google.

Mercoledì Google ha presentato Gemini 4 Argon, definendolo un modello di frontiera per l’ingegneria del software, il lavoro complesso basato sulla conoscenza e la difesa informatica. L’amministratore delegato Sundar Pichai ha affermato che i team di Google lo stavano già utilizzando ampiamente, descrivendo “prestazioni di frontiera nei flussi di lavoro complessi, nella difesa informatica e nell’ingegneria del software.”

La tesi di Google si basa sia sull’impiego interno sia sui benchmark. L’azienda afferma che Argon ha contribuito a liberare 300 TiB di memoria nei data center e a migrare grandi codebase C/C++ a Rust; ha inoltre citato un risultato del 77,9% nel benchmark di ingegneria del software DeepSWE v1.1, davanti a rivali nominati. Tuttavia, l’azienda non ha annunciato i prezzi delle API né una data di lancio pubblico, il che significa che gli sviluppatori non possono riprodurre indipendentemente tali risultati.

Secondo Google, la cautela è deliberata. Inizialmente Argon sarà destinato a partecipanti governativi e difensori informatici verificati attraverso il suo Fairwind Program, mentre l’azienda rafforza le protezioni contro l’uso improprio, la prompt injection e il disallineamento. Il responsabile di DeepMind Demis Hassabis ha definito la decisione un rilascio responsabile e graduale “prima di una disponibilità più ampia.”

Questo approccio ha un doppio risvolto. Google afferma che riflette i rischi di un modello capace di identificare e correggere gravi vulnerabilità software; gli scettici osservano che benchmark impressionanti non stabiliscono come un modello si comporti nelle caotiche condizioni del mondo reale. Axios ha riferito che dipendenti anonimi avevano riscontrato carenze in alcuni aspetti dei test interni—un resoconto contestato da Google—e ha avvertito che i modelli possono essere addestrati per eccellere nei benchmark.

Per ora, Argon è la più forte scommessa di Google per recuperare terreno nell’IA ad alto rischio. Se si tratti davvero di un salto di qualità, tuttavia, resta una domanda per gli osservatori esterni che non sono ancora autorizzati a usarlo.