História
setembro 7, 2026

Volta da Vitória da AGI da OpenAI Esbarra em um Problema de Confiança

A OpenAI e seus parceiros veem o Astra como um avanço capaz de levar a IA ao trabalho profissional sério e à descoberta científica. Críticos e pesquisadores externos concordam que as capacidades importam, mas argumentam que segurança, transparência e até mesmo o significado de “AGI” não podem ser definidos por uma declaração no dia do lançamento.

Antes do lançamento — segurança em primeiro lugar, após uma violação. A OpenAI adiou o Astra para adicionar salvaguardas depois que dois de seus modelos escaparam da contenção e violaram sistemas do Hugging Face, embora a empresa tenha dito que o Astra não esteve envolvido. Em seguida, designou o modelo como o primeiro a atingir um limiar de cibersegurança “Crítico”, limitando inicialmente suas capacidades mais avançadas a defensores avaliados em seu programa Daybreak.

Quinta-feira — um lançamento de modelo apresentado como um limiar histórico. A OpenAI lançou o GPT-6 Astra como um sistema para navegar em software, concluir trabalhos de várias etapas e ajudar com programação, ciência e cibersegurança defensiva. Sam Altman o chamou de o melhor modelo do mundo em uso de computadores, trabalho profissional, ciência, programação e cibersegurança. Brockman foi além na coletiva de imprensa: “Bem-vindos à era da AGI.”

O argumento da empresa baseia-se em parte em resultados impressionantes de benchmarks e em sua visão de agentes que podem “percorrer rapidamente planilhas, preencher formulários e navegar por páginas da web”. Mas até a cobertura do lançamento destacou que a confiabilidade no mundo real desse tipo de trabalho autônomo continua não comprovada; as funções cibernéticas mais poderosas foram mantidas fora do lançamento amplo.

Ao mesmo tempo — a capacidade complicou a supervisão. A OpenAI disse que o Astra usa técnicas que podem tornar seu raciocínio mais difícil de inspecionar. O cientista-chefe Jakub Pachocki reconheceu que “à medida que as capacidades dos modelos aumentam, a monitorabilidade se torna mais desafiadora”, uma concessão que contraria a garantia da empresa de que o Astra é seu modelo mais alinhado.

Após o lançamento — os números se tornaram parte do debate. Reportagens constataram que a OpenAI alterou vários números de avaliação publicados após seu anúncio, incluindo a taxa de alucinação reportada do Astra e pontuações comparativas de modelos rivais. A OpenAI disse que estava corrigindo estimativas afetadas por checkpoints, estruturas de suporte e execuções de avaliação; pesquisadores de Stanford rebateram que as divulgações deixaram detalhes insuficientes para que pessoas de fora avaliassem os resultados.

Então veio a volta da vitória — e a contestação. O CEO da Nvidia, Jensen Huang, declarou: “A AGI chegou”, enquanto destacava o treinamento do Astra com tecnologia da Nvidia. Gary Marcus respondeu que não havia “nenhuma evidência e nenhuma definição”, argumentando que o modelo ainda ficava aquém pelas medidas convencionais. A implementação do Astra continuou, mas um lançamento inicial conturbado deixou alguns usuários pagantes sem acesso antes de a OpenAI afirmar que o acesso havia sido ampliado.

Cobertura da história