Notícia
outubro 1, 2026
Google afirma que o Gemini 4 Argon é um avanço — mas o público ainda não pode testá-lo
O Google apresenta o Gemini 4 Argon como um retorno consciente em relação à segurança à fronteira da IA, enquanto a cobertura externa vê um modelo com alegações formidáveis, mas evidências limitadas disponíveis para escrutínio independente. Sua implementação restrita faz da cautela parte do argumento do Google — e da principal razão pela qual as alegações permanecem não comprovadas.
O Google havia prometido um grande lançamento de modelo para junho, amplamente esperado como o Gemini 3.5 Pro. Esse lançamento nunca aconteceu, após um período em que a empresa lançou modelos Flash menores, enquanto OpenAI e Anthropic avançavam. Relatos dizem que o atraso ocorreu após preocupações internas sobre desempenho e moral, elevando a importância do próximo carro-chefe do Google.1
Na quarta-feira, o Google apresentou o Gemini 4 Argon, chamando-o de um modelo de fronteira para engenharia de software, trabalho complexo com conhecimento e ciberdefesa. O CEO Sundar Pichai disse que as equipes do Google já o utilizavam amplamente, descrevendo “desempenho de fronteira em fluxos de trabalho complexos, ciberdefesa e engenharia de software”.
2
O argumento do Google se baseia tanto na implantação interna quanto em benchmarks. A empresa afirma que o Argon ajudou a liberar 300 TiB de memória de data centers e a migrar grandes bases de código C/C++ para Rust; também citou um resultado de 77,9% no benchmark de engenharia de software DeepSWE v1.1, à frente de concorrentes nomeados. Ainda assim, a empresa não anunciou preços de API nem uma data de lançamento público, o que significa que desenvolvedores não podem reproduzir esses resultados de forma independente.3
A restrição é deliberada, segundo o Google. Inicialmente, o Argon será destinado a participantes governamentais e defensores cibernéticos avaliados por meio de seu Fairwind Program, enquanto a empresa reforça proteções contra uso indevido, injeção de prompt e desalinhamento. O chefe da DeepMind, Demis Hassabis, caracterizou a decisão como um lançamento responsável e escalonado “antes de uma disponibilidade mais ampla”.
4
Essa abordagem tem dois lados. O Google diz que ela reflete os riscos de um modelo capaz de identificar e corrigir falhas graves de software; céticos observam que benchmarks impressionantes não determinam como um modelo se comporta em condições confusas do mundo real. A Axios informou que funcionários anônimos consideraram insuficientes aspectos dos testes internos — relato contestado pelo Google — e alertou que modelos podem ser treinados para se destacarem em benchmarks.1
Por enquanto, o Argon é a aposta mais forte do Google para recuperar terreno em IA de alto risco. Se ele representa um salto genuíno, no entanto, continua sendo uma questão para os agentes externos que ainda não têm permissão para usá-lo.