Storia
ottobre 1, 2026

Google afferma che Gemini 4 Argon è pronto per la frontiera, ma il pubblico deve aspettare

Google presenta il debutto limitato di Gemini 4 Argon come una gestione responsabile di un potente strumento di difesa informatica, mentre le cronache esterne descrivono l'esclusione come un promemoria del fatto che benchmark e affermazioni interne devono ancora affrontare un ampio scrutinio nel mondo reale.

Il percorso di Google verso Gemini 4 Argon è iniziato con un passo falso. A maggio, il CEO Sundar Pichai aveva annunciato un importante rilascio di modello per giugno, ma l'atteso Gemini 3.5 Pro non è mai arrivato; Google ha invece trascorso l'estate rilasciando modelli Flash più economici, mentre OpenAI e Anthropic andavano avanti.

Mercoledì, Google ha finalmente presentato Argon, definendolo un modello di frontiera per l'ingegneria del software, il lavoro aziendale e la difesa informatica. L'azienda afferma che i team interni lo hanno utilizzato per complessi lavori di programmazione e ricerca, riferendo al contempo che Argon ha contribuito a liberare oltre 300 tebibyte di memoria nei data center e a migrare grandi basi di codice da C/C++ a Rust.

La tesi di Google sulle prestazioni si basa in larga misura sui benchmark: afferma che Argon ha ottenuto il 77,9% su DeepSWE v1.1 e ha guidato il Vals Index per le attività di analisi economica. Demis Hassabis ha rilanciato quest'ultima affermazione su X, dichiarando che Gemini 4 Argon aveva conquistato “il primo posto nel Vals Index con il 68,9%”. L'azienda afferma inoltre che il modello può produrre fino a 1 milione di token, ben oltre il limite di 64.000 token dei precedenti sistemi Gemini.

Ma il lancio presenta un'evidente avvertenza: quasi nessuno può utilizzarlo. Google sta inizialmente fornendo Argon solo a partner governativi e di cybersicurezza verificati attraverso il suo Fairwind Program, partecipando al contempo al processo volontario di revisione pre-rilascio del governo degli Stati Uniti. Pichai ha affermato che il modello disponeva di “protezioni di frontiera” e che sarebbe arrivato agli utenti “non appena potremo e nel modo più sicuro possibile”.

Questa cautela è la risposta di Google al rischio di uso improprio, prompt injection e disallineamento. L'azienda afferma di monitorare la catena di pensiero del modello e di poterlo interrompere quando supera i limiti. Eppure il rilascio limitato rimanda anche il test più importante: se il vantaggio di Argon nei benchmark resista all'uso ordinario. Axios ha osservato che dipendenti anonimi avrebbero segnalato prestazioni interne insufficienti — una ricostruzione contestata da Google — e ha avvertito che i modelli possono essere addestrati a eccellere nei test senza eguagliare tale forza nel mondo reale.

Per ora, Google ha riconquistato i riflettori, non necessariamente il verdetto. Una più ampia disponibilità è promessa dopo ulteriori test, a partire dai clienti API a pagamento e dagli abbonati ad AI Ultra, ma non è stata indicata alcuna data.