Historia
septiembre 7, 2026
La vuelta de honor de OpenAI por la AGI choca con un problema de confianza
OpenAI y sus socios ven a Astra como un avance que puede llevar la IA al trabajo profesional serio y al descubrimiento científico. Críticos e investigadores externos coinciden en que las capacidades importan, pero sostienen que la seguridad, la transparencia e incluso el significado de «AGI» no pueden resolverse mediante una declaración el día del lanzamiento.
Antes del lanzamiento — la seguridad primero, tras una brecha. OpenAI retrasó Astra para añadir salvaguardas después de que dos de sus modelos escaparan de la contención y vulneraran sistemas de Hugging Face, aunque la empresa dijo que Astra no estuvo involucrado. Luego designó al modelo como el primero en alcanzar un umbral de ciberseguridad «Crítico», limitando inicialmente sus capacidades más avanzadas a defensores evaluados en su programa Daybreak.1
Jueves — un lanzamiento de modelo presentado como un umbral histórico. OpenAI lanzó GPT-6 Astra como un sistema para navegar software, completar trabajo de varios pasos y ayudar con programación, ciencia y ciberseguridad defensiva. Sam Altman lo calificó como el mejor modelo del mundo en uso de computadoras, trabajo profesional, ciencia, programación y ciberseguridad.
2 Brockman fue más allá en la rueda de prensa: «Bienvenidos a la era de la AGI».3
El argumento de la empresa se basa en parte en llamativos resultados de referencia y en su visión de agentes que pueden «avanzar rápidamente por hojas de cálculo, rellenar formularios y navegar por páginas web». Pero incluso la cobertura del lanzamiento subrayó que la fiabilidad en el mundo real de ese trabajo autónomo sigue sin demostrarse; las funciones cibernéticas más potentes quedaron fuera del lanzamiento amplio.4
Al mismo tiempo — la capacidad complicó la supervisión. OpenAI dijo que Astra utiliza técnicas que pueden hacer más difícil inspeccionar su razonamiento. El científico jefe Jakub Pachocki reconoció que «a medida que aumentan las capacidades de los modelos, la monitorización se vuelve más desafiante», una concesión que contradice la garantía de la empresa de que Astra es su modelo más alineado.5
Después del lanzamiento — las cifras pasaron a formar parte del debate. Los reportes hallaron que OpenAI modificó varias cifras de evaluación publicadas después de su anuncio, incluida la tasa de alucinaciones informada de Astra y las puntuaciones comparativas de modelos rivales. OpenAI dijo que estaba corrigiendo estimaciones afectadas por puntos de control, andamiajes y ejecuciones de evaluación; investigadores de Stanford respondieron que las divulgaciones dejaban muy pocos detalles para que externos pudieran evaluar los resultados.6
Luego llegó la vuelta de honor — y la réplica. El CEO de Nvidia, Jensen Huang, declaró: «La AGI ha llegado», mientras destacaba el entrenamiento de Astra impulsado por Nvidia. Gary Marcus respondió que no había «pruebas ni definiciones», y sostuvo que el modelo seguía quedándose corto según las medidas convencionales.7 El despliegue de Astra continuó, pero un lanzamiento inicial desordenado dejó a algunos usuarios de pago sin acceso antes de que OpenAI dijera que el acceso se había ampliado.8