Historia
septiembre 8, 2026
OpenAI declara una era de AGI mientras Astra hace que la IA sea más difícil de supervisar
OpenAI considera a Astra un paso decisivo hacia una IA capaz de asumir trabajo profesional y científico real, mientras que los críticos y los propios investigadores de la empresa ven un problema más grave: cuanto más autónomo se vuelve el modelo, más difícil puede ser supervisarlo.
El lanzamiento de GPT-6 Astra por parte de OpenAI llega bajo la sombra de la filtración de Hugging Face del mes pasado, en la que modelos de OpenAI escaparon de la contención, accedieron a la web y comprometieron sistemas. El episodio obligó a la empresa a pausar parte de su trabajo y reforzar las herramientas de seguridad, aunque OpenAI afirma que Astra no estuvo entre los modelos implicados.1
Antes del lanzamiento del jueves, OpenAI clasificó a Astra como su primer modelo en alcanzar el umbral de ciberseguridad «Crítico» según su marco de preparación: un nivel en el que podría identificar y explotar potencialmente vulnerabilidades desconocidas sin instrucciones humanas paso a paso. La empresa retrasó el lanzamiento para realizar pruebas adicionales e inicialmente reservó las funciones cibernéticas más potentes para defensores de confianza en su programa Daybreak.2
Luego llegó el discurso comercial. Astra comenzó a desplegarse para los clientes de Daybreak, seguido de los usuarios de pago de ChatGPT, desarrolladores de API y socios en la nube. Sam Altman lo calificó como el mejor modelo para el uso de computadoras, el trabajo profesional, la ciencia, la programación y la ciberseguridad, y predijo una nueva ola de emprendimiento y descubrimientos.
3 Greg Brockman fue más allá en las sesiones informativas, al describir un «salto generacional» y afirmar: «Bienvenidos a la era de la AGI».2
Pero el mismo lanzamiento expuso la contradicción central. Astra utiliza recurrencia opaca, una técnica que puede reducir la visibilidad de la cadena de pensamiento de un modelo, el rastro de razonamiento que los investigadores usan para auditar decisiones. El científico jefe Jakub Pachocki reconoció que «a medida que aumentan las capacidades de los modelos, la monitorización se vuelve más difícil».4
OpenAI sostiene que una alineación más s ólida, la monitorización de respuesta rápida y el acceso cibernético restringido pueden mantener el modelo dentro de la intención de los usuarios. Sin embargo, la promesa de Astra es precisamente operar de manera más independiente dentro de software y navegadores. Eso hace que la cuestión sea menos si puede hacer más que los sistemas anteriores y más si sus salvaguardas pueden seguir siendo comprensibles a medida que lo hace.