OpenAI a început oficial rollout-ul pentru GPT-6 Astra, succesorul lui GPT-5.6 Sol și noul model frontier al companiei.
OpenAI trece direct la GPT-6, descriind Astra drept cel mai inteligent și mai bine aliniat model construit până acum de companie și declarând performanțe de ultimă generație în raționament, matematică, știință, software engineering, cybersecurity, browsing și muncă profesională complexă.
Rollout-ul a început pe 3 septembrie, inițial pentru un grup restrâns de organizații, iar în următoarele zile Astra urmează să devină disponibil pentru toți utilizatorii ChatGPT.
🧠 De la răspunsuri la rezolvarea problemelor
Saltul important nu pare să fie doar capacitatea Astra de a răspunde mai corect la o întrebare.
Modelul a fost construit pentru a primi o problemă complexă, a o analiza, a folosi instrumentele disponibile, a menține obiectivul pe parcursul unui task lung și a ajunge la un rezultat final.
OpenAI spune că Astra este mai bun inclusiv la păstrarea contextului atunci când utilizatorul introduce cerințe noi pe parcurs. Modelele precedente puteau interpreta uneori o intervenție drept un obiectiv complet nou; Astra este proiectat să integreze modificarea fără să piardă scopul inițial.
În context foarte lung, diferența devine spectaculoasă: pe evaluarea OpenAI MRCR între 512.000 și 1 milion de tokenuri, Astra obține 96,3%, comparativ cu 73,8% pentru GPT-5.6 Sol.
Pentru research, investigații, documente numeroase și analize construite din multe surse, acesta poate fi unul dintre cele mai importante salturi.
🧮 Astra excelează în matematică și știință
Una dintre cele mai impresionante evoluții apare în matematică.
Pe FrontierMath Tier 4 v2, unul dintre cele mai dificile benchmarkuri matematice, rezultatele sunt:
GPT-6 Astra — 97,6%
GPT-5.6 Sol — 83,0%
Claude Fable 5.1 — 87,8%
Iar pe Terminal-Bench Science 0.1, diferența față de generația precedentă este uriașă:
GPT-6 Astra — 64,6%
Claude Fable 5.1 — 52,6%
GPT-5.6 Sol — 22,4%.
🔐 Cybersecurity: aici saltul este și mai mare
OpenAI spune că Astra a ajuns într-o zonă de capabilități cyber foarte avansate, inclusiv agentic coding și găsirea de vulnerabilități complexe.
Cybersecurity este probabil domeniul în care Astra produce cea mai mare schimbare.
GPT-6 Astra este primul model OpenAI despre care compania spune că atinge pragul Critical pentru capabilități cyber în cadrul Preparedness Framework.
Asta înseamnă că, în configurațiile de evaluare potrivite, modelul poate găsi vulnerabilități necunoscute anterior și poate dezvolta lanțuri de exploatare pentru sisteme reale foarte bine protejate.
Pe ExploitBench:
Astra — 100%
GPT-5.6 Sol — 78,5%
Pe ExploitGym:
Astra — 42,4%
Claude Fable 5.1 — 30,4%
GPT-5.6 Sol — 30,3%
Iar pe SRE-Bench, Astra ajunge la 88%, față de numai 55,9% pentru Sol.
Într-un benchmark intern realizat cu vulnerabilități descoperite între iunie și august 2026, Astra a obținut 39%, comparativ cu 11,5% pentru Sol.
În timpul acestor evaluări, modelul a descoperit chiar două vulnerabilități zero-day necunoscute anterior, pe care OpenAI spune că le raportează responsabil dezvoltatorilor afectați.
⚔️ GPT-6 Astra vs Claude Fable 5.1
Aici începe probabil cea mai interesantă competiție dintre modelele frontier.
Claude Fable 5.1 fusese lansat de Anthropic pe 1 septembrie, cu numai două zile înainte de Astra, drept cel mai puternic model Claude pentru coding și knowledge work.
Dar Astra îl depășește pe mai multe dintre benchmarkurile importante publicate acum:
AutomationBench: 41,4% Astra vs 31,4% Fable 5.1
BenchCAD: 95,9% vs 84,3%
Terminal-Bench 4.0: 57,9% vs 55,8%
DeepSWE 1.1: 74,1% vs 67,4%
FrontierMath Tier 4: 97,6% vs 87,8%
GPQA Diamond: 96,0% vs 93,7%
Terminal-Bench Science: 64,6% vs 52,6%
ExploitGym: 42,4% vs 30,4%.
💻 Mai rapid și mai autonom
Astra face și un salt important în computer use.
Pe OSWorld 2.0 obține 72,6%, față de 65,7% pentru GPT-5.6 Sol, dar finalizează taskurile simulate în aproximativ 40 de minute, comparativ cu aproximativ 75 de minute pentru Sol.
Asta înseamnă aproape 47% mai puțin timp per task, concomitent cu o rată de succes mai mare.
OpenAI spune că Astra poate efectua activități precum research online, completarea formularelor, organizarea calendarului, lucrul în CRM-uri, analiza datelor, crearea de site-uri și testarea lor, realizarea de documente, prezentări și spreadsheet-uri.
🌌 De la Sol la Astra
GPT-5.6 Sol a ridicat foarte mult nivelul raționamentului și analizei.
Astra pare însă construit pentru următoarea etapă: mai mult context, mai multă autonomie, raționament mai eficient, memorie contextuală îmbunătățită, matematică mult mai puternică și capacitatea de a duce probleme complexe până la capăt.
Rollout-ul a început.
Acum mai rămâne doar să apară în selectorul ChatGPT:
GPT-6 Astra 🚀

