Storia
ottobre 3, 2026

Google afferma che Gemini 4 Argon è un'IA di frontiera: perché allora è ancora sotto stretto controllo?

Google presenta Gemini 4 Argon come un atteso ritorno nell'IA ad alta posta in gioco, mentre il suo lancio strettamente controllato riflette sia i rischi informatici di un modello potente sia le persistenti domande sul fatto che le vittorie nei benchmark si tradurranno in prestazioni affidabili nel mondo reale.

Il nuovo modello di punta di Google arriva dopo una vistosa attesa. L'azienda aveva indicato che il suo prossimo modello principale sarebbe apparso a giugno, ma l'atteso Gemini 3.5 Pro non si è mai materializzato; secondo alcune notizie, i ritardi erano legati a prestazioni deboli e problemi di morale interno.

Mercoledì, Google ha presentato Gemini 4 Argon, sostenendo che il tempo supplementare abbia prodotto un modello capace di lavoro prolungato nell'ingegneria del software, nella finanza, nell'analisi legale e nella difesa informatica. Sundar Pichai lo ha definito un sistema con «prestazioni di frontiera in flussi di lavoro complessi, difesa informatica e ingegneria del software», aggiungendo che i team di Google lo stavano già utilizzando ampiamente.

Le prove presentate dall'azienda sono ambiziose. Google afferma che Argon eguaglia GPT-6 Astra di OpenAI al vertice di CWE-bench per l'individuazione e la correzione di falle di sicurezza, stabilisce un nuovo record nei compiti di ingegneria del software a lungo orizzonte e ha contribuito a liberare oltre 300 tebibyte di memoria nei data center senza nuovo hardware. Il capo di DeepMind, Demis Hassabis, ha inoltre evidenziato un risultato separato del Vals Index che colloca Argon al primo posto con il 68,9%.

Tuttavia, Google non considera tali prestazioni come una licenza per un rilascio su vasta scala. Inizialmente Argon sarà destinato a partner governativi e di cybersecurity selezionati attraverso il Fairwind Program, mentre l'azienda partecipa al processo volontario di revisione pre-rilascio del governo degli Stati Uniti. Pichai ha affermato che il modello dispone di «protezioni di frontiera» e sarebbe stato reso disponibile «non appena possibile e nel modo più sicuro possibile».

Tulsee Doshi, responsabile del prodotto Gemini di Google, ha descritto il lancio limitato come un modo per offrire un solido strumento difensivo alle persone che ne hanno bisogno, costruendo al tempo stesso fiducia: «un modello di questo livello e con queste prestazioni di frontiera è significativamente importante per i difensori».

Quella cautela rappresenta anche un riconoscimento implicito della questione senza risposta. Bloomberg ha riferito che alcuni dipendenti di Google hanno trovato Argon poco impressionante nei test interni, una ricostruzione contestata da Google. La divisione evidenzia il noto problema dell'IA di frontiera: i punteggi nelle classifiche possono segnalare progressi, ma gli sviluppatori decideranno se Google è davvero tornata competitiva solo quando Argon darà risultati al di fuori del laboratorio.