OpenAI a confirmat că GPT-6 Astra este primul său model care atinge nivelul „Critical” pentru capabilități de securitate cibernetică, conform propriului Preparedness Framework.
Este un prag important.
În terminologia OpenAI, „Critical” nu înseamnă că modelul este considerat în mod automat periculos sau necontrolabil. Înseamnă că nivelul său de capabilitate a ajuns suficient de departe încât, având instrumentele și accesul potrivite, Astra poate identifica vulnerabilități necunoscute anterior și poate dezvolta modalități de exploatare a acestora în sisteme bine protejate, fără ca un operator uman să fie nevoit să-i indice fiecare pas.
Ce înseamnă „Critical”
Preparedness Framework definește acest nivel prin scenarii extrem de avansate. Printre criterii se află capacitatea unui model de a identifica și transforma vulnerabilități zero-day în exploit-uri funcționale pentru numeroase sisteme reale bine securizate sau de a concepe strategii noi de atac cibernetic pornind doar de la un obiectiv general.
Evaluările Astra au combinat benchmark-uri automate, teste private și evaluări realizate de specialiști.
Pe ExploitBench, un test destinat dezvoltării de exploit-uri pornind de la vulnerabilități cunoscute, Astra a obținut un scor de 100%. OpenAI a construit apoi un benchmark intern cu 20 de vulnerabilități V8 de severitate ridicată, publicate recent, tocmai pentru a reduce riscul ca modelul să fi întâlnit anterior datele testului. Astra a demonstrat rezultate semnificativ mai bune decât GPT-5.6 Sol și cu un consum mai redus de tokeni.
Mai spectaculos este că, în timpul acestor evaluări, modelul a descoperit și utilizat două vulnerabilități zero-day într-un lanț de exploatare. OpenAI spune că se află în procesul de divulgare responsabilă a acestora către dezvoltatorii software afectați.
În alte teste conduse de experți, Astra a identificat vulnerabilități necunoscute anterior într-un browser securizat și într-un sistem de operare întărit, reușind să combine mai multe probleme de securitate în lanțuri funcționale. Aceste rezultate au contribuit la decizia OpenAI de a clasifica modelul la nivelul Critical.
Putere mare, restricții mai mari
Tocmai aceste capabilități explică de ce OpenAI spune că a consolidat semnificativ sistemele de protecție înainte de lansarea Astra.
Compania a introdus măsuri suplimentare pentru limitarea abuzului, monitorizarea acțiunilor modelului, izolarea infrastructurii, protejarea checkpoint-urilor și detectarea activităților care ar putea ieși din limitele autorizate. OpenAI spune inclusiv că anumite etape de dezvoltare și lansare Astra au fost întârziate pentru ca aceste protecții să fie testate și întărite.
Capabilitățile cyber cele mai avansate nu sunt nici ele oferite fără restricții. OpenAI precizează că accesul inițial la astfel de funcții este limitat, urmând să fie extins în primul rând către utilizări defensive și către persoane sau organizații de încredere.
Aceeași tehnologie poate apăra sau ataca
Aici apare paradoxul.
Un model capabil să găsească o vulnerabilitate necunoscută înaintea unui atacator poate deveni una dintre cele mai puternice unelte defensive create vreodată.
Dar exact aceeași capacitate, folosită cu intenții malițioase și fără restricții, ar putea reduce dramatic timpul, costurile și nivelul de expertiză necesare pentru anumite atacuri informatice.
OpenAI descrie printre scenariile de risc dezvoltarea unor exploit-uri împotriva unor sisteme răspândite, atacurile asupra infrastructurilor critice și compromiterea unor sisteme financiare importante.
De aici și miza lansării GPT-6 Astra.
Nu mai vorbim doar despre un model care scrie cod mai bine sau rezolvă benchmark-uri mai dificile.
Vorbim despre un model AI care, potrivit propriilor evaluări OpenAI, a trecut pentru prima dată într-o categorie în care capacitatea de a descoperi vulnerabilități software necunoscute devine suficient de puternică încât necesită un nou nivel de securitate în jurul modelului însuși.

