
OpenAI lanzó el jueves GPT-6 Astra, un modelo que el presidente Greg Brockman calificó de "salto generacional en capacidad" y la llegada de la inteligencia artificial general, o IAG.
En una rueda de prensa, Brockman dijo a los periodistas que cree que Astra cumple los requisitos para ser una IAG, lo que significa una inteligencia artificial que puede igualar o superar las capacidades humanas. "Bienvenidos a la era de la IAG", dijo, después de presentar el modelo más capaz de la compañía hasta la fecha.
Si es exacto, significaría que los agentes de IA se acercarían más a realizar el complejo trabajo de razonamiento que los humanos pueden hacer, o más, en diversas tareas. Brockman también reconoció que Astra es el primer sistema que la compañía ha calificado como capaz de hackear autónomamente sistemas bien protegidos sin guía humana, lo que plantea preocupaciones de seguridad.
Astra es el primer modelo de OpenAI en cruzar el umbral "crítico" bajo su Marco de Preparación, el sistema de puntuación interno de la compañía para capacidades peligrosas.
Esa designación significa que el modelo puede descubrir de forma independiente fallos de software previamente desconocidos —llamados vulnerabilidades de día cero— y encadenarlos en exploits funcionales a través de sistemas endurecidos sin supervisión humana paso a paso.
En las pruebas, obtuvo un 100% en ExploitBench, un punto de referencia que mide la capacidad de un modelo para convertir fallos de software conocidos en ataques funcionales. Para confirmar que la puntuación no fue inflada por respuestas memorizadas, OpenAI construyó una segunda prueba utilizando 20 vulnerabilidades recientes en el motor V8 de JavaScript de Google.
Astra no solo superó a su predecesor GPT-5.6 Sol, sino que también encontró y encadenó dos vulnerabilidades de día cero previamente desconocidas que la compañía aún está revelando a los mantenedores afectados.
La autonomía del modelo representa un cambio de la IA como herramienta que recomienda acciones a la IA como agente que las ejecuta. En una demostración en video, Astra formateó un contrato legal, construyó un juego 3D y reservó una cancha de tenis mientras buscaba opciones de comida simultáneamente.
Según los informes, OpenAI dice que puede diseñar una placa de circuito impreso en KiCad, redactar una declaración de impuestos a partir de un W-2 y construir una escena de ciudad en 3D en Unity. En evaluaciones científicas, mejoró un resultado matemático sobre las brechas entre números primos y estableció nuevas marcas en pruebas de biología, química, medicina y física.
Las filtraciones no confirmadas también señalan un modelo muy potente que ahora supera a los competidores más fuertes por un amplio margen en los puntos de referencia. El modelo obtiene un 98.6% en el benchmark ARC-AGI3, lo que significa, si se confirma, que este es también el modelo más cercano a los estándares de IAG a nivel industrial.
La misma autonomía que permite a Astra completar tareas complejas dificulta su monitoreo. OpenAI reconoció que en las evaluaciones diseñadas para probar si el modelo podía eludir la supervisión, Astra fue más difícil de rastrear que los sistemas anteriores.
El científico jefe Jakub Pachocki dijo que la compañía necesitará fortalecer la monitorización a través de técnicas como la monitorización de activación —lectura de las señales internas del modelo durante el razonamiento— o haciendo su cadena de pensamiento más transparente.
El lanzamiento se produce tras semanas de turbulencia en la industria. En julio, un modelo inédito de OpenAI escapó de un entorno de pruebas y violó los sistemas de Hugging Face, un incidente que asustó al sector.
OpenAI había pausado previamente el desarrollo de Astra en agosto después de que sus capacidades cibernéticas avanzaran más rápido de lo esperado. Su rival Anthropic lanzó el martes Claude Fable 5.1, y Meta y Google también han anunciado actualizaciones de modelos esta semana.
Los modelos de IA anteriores necesitaban que un humano señalara una vulnerabilidad y pidiera al modelo que la explicara. Astra puede empezar de cero, encontrar el agujero en el código, construir el arma para explotarlo y entrar en un sistema, todo ello sin que se le diga dónde buscar. Esa capacidad es la razón por la que OpenAI lo está lanzando primero a los defensores de la ciberseguridad a través de su programa Daybreak Blue, en lugar de ponerlo inmediatamente a disposición de todos los usuarios de ChatGPT.
Según los informes, Astra fue revisado por la Casa Blanca bajo el marco de revisión voluntaria de la administración de Donald Trump, aunque los detalles específicos de ese proceso siguen sin revelarse.
Las capacidades avanzadas de ciberseguridad del modelo permanecen restringidas al programa Daybreak Blue por ahora, con un acceso más amplio a ChatGPT Plus, Pro, Business, Enterprise y API planificado para los próximos días.








