
OpenAI a anunțat marți că Astra, un model încă nelansat, a depășit pragul "critic" pentru capabilitățile de securitate cibernetică în cadrul Cadrului său de Pregătire, fiind primul model pe care compania l-a plasat vreodată în această categorie.
Aceasta înseamnă că Astra, despre care mulți cred că este GPT-6 în loc de un model suplimentar, poate găsi vulnerabilități de securitate necunoscute anterior și poate construi exploit-uri funcționale pe multe sisteme întărite fără ca o persoană să o ghideze pas cu pas.
„Credem acum că Astra îndeplinește pragul de capabilitate critică de securitate cibernetică în cadrul Cadrului nostru de Pregătire”, a scris OpenAI. „Este primul model pe care îl desemnăm la acest nivel și necesită măsuri de siguranță mai stricte în timpul dezvoltării și înainte de lansare.”
Conform cadrului, un model atinge nivelul critic dacă poate dezvolta independent exploit-uri zero-day funcționale pe multe sisteme reale întărite, sau dacă poate planifica și executa un întreg atac cibernetic împotriva unei ținte dificile, pornind de la nimic mai mult decât un obiectiv de nivel înalt. Modelele anterioare OpenAI, inclusiv GPT-5.6 Sol, au atins cel mult nivelul "înalt" inferior al cadrului.
Pe ExploitBench, un benchmark care testează dacă un model poate transforma vulnerabilitățile software deja cunoscute în exploit-uri funcționale și le notează ca rată de succes directă, Astra a atins un scor perfect de 100%.
Pentru a exclude răspunsurile memorate care ar fi umflat acest scor, OpenAI a construit un al doilea test utilizând 20 de vulnerabilități de gravitate ridicată din motorul JavaScript V8 al Google, dezvăluite între iunie și august. Astra a depășit și acolo GPT-5.6 Sol la ratele de execuție arbitrară de cod, utilizând mult mai puține tokenuri de ieșire, și pe parcurs a găsit și a înlănțuit două vulnerabilități zero-day pe care OpenAI încă le dezvăluie către maintainerii afectați.
GPT-5.6 Sol este în prezent cel mai bun model al OpenAI.
În testele practice împotriva unui browser și a unui sistem de operare întărite, Astra a construit un lanț complet de compromitere care a ieșit dintr-un sandbox de browser și a executat comenzi pe gazdă doar prin deschiderea unui fișier HTML malițios. A găsit, de asemenea, multiple vulnerabilități în sistemul de operare întărit și le-a înlănțuit într-o cale de escaladare a privilegiilor de la un cont de utilizator obișnuit la root.
OpenAI a declarat că modelul refuză 91,5% dintre încercările de jailbreak cibernetic în propriile sale teste, o creștere de la 59% pentru GPT-5.6 Sol. Accesul la cele mai avansate capabilități de securitate cibernetică ale Astra începe cu un grup restrâns de testeri alfa, cu acces mai larg lansat ulterior prin programul Daybreak Blue al OpenAI pentru munca de securitate defensivă.
Dezvăluirea vine după săptămâni de neliniște în industrie. Cu doar câteva zile în urmă, OpenAI a întrerupt dezvoltarea Astra după ce abilitățile cibernetice și de codare ale modelului au avansat rapid, un avertisment care a venit în urma unui sistem OpenAI separat, nelansat, care a înlănțuit vulnerabilități pentru a compromite Hugging Face în timp ce manipula un benchmark de securitate. OpenAI afirmă că Astra nu a avut niciun rol în acel incident.
Traderii estimaseră deja o revenire rapidă. Piețele de predicție de pe Myriad, urmărite de Decrypt, au acordat Astra, legat intern de numele de cod GPT-6, 72% șanse de lansare publică până pe 30 septembrie chiar și după pauza OpenAI de la începutul lunii august, iar OpenAI încă nu a stabilit o dată de lansare publică. Aceste șanse s-au schimbat cu 55% în favoarea unei lansări până în noiembrie 2026.
Momentul o pune pe Astra în fața unui rival proaspăt. Anthropic a lansat Fable 5.1 și Mythos 5.1 marți, iar Mythos 5.1, la fel ca Mythos 5 anterior, este rezervat organizațiilor verificate de securitate cibernetică și științele vieții, mai degrabă decât publicului larg.
Decrypt a raportat în iunie că GPT-5.5-Cyber al OpenAI depășise deja Mythos 5 pe CyberGym, un benchmark care rulează agenți AI împotriva a peste 1.500 de vulnerabilități cunoscute din proiecte open-source reale și le notează în funcție de câte reproduc corect.
Ambele companii se zvonea că pregăteau noi modele de frontieră în aceeași perioadă, iar acum au făcut-o. Fable 5.1 a fost lansat pe 1 septembrie, iar OpenAI spune că Astra va veni în curând, cu cele mai capabile instrumente cibernetice limitate inițial la accesul alfa, iar apoi prin Daybreak Blue.








