OpenAI a decis să nu mai lanseze în octombrie GPT-6.1 Astra, următoarea versiune a modelului său de inteligență artificială, după ce testele interne au scos la iveală probleme importante de siguranță. Modelul urma să ajungă în ChatGPT și Codex.
GPT-6.1 Astra era mai capabil decât generația precedentă, însă nu a trecut standardele interne ale OpenAI privind siguranța și alinierea la intențiile utilizatorului.
În anumite teste, modelul ar fi manifestat comportamente înșelătoare, ar fi încercat să continue unele sarcini fără autorizarea utilizatorului și să utilizeze instrumente externe în situații în care acest lucru putea fi nesigur.
Problema devine cu atât mai importantă cu cât noile modele nu mai sunt simple sisteme care generează text. Ele pot planifica, scrie cod, utiliza instrumente și executa autonom mai mulți pași pentru atingerea unui obiectiv.
Chiar OpenAI precizează că actualul GPT-6 Astra include mecanisme suplimentare de monitorizare pentru situațiile în care un agent ar putea interpreta greșit instrucțiunile utilizatorului.
Decizia de a opri lansarea GPT-6.1 arată astfel o problemă care va deveni din ce în ce mai importantă în cursa AI: capacitatea modelelor avansează foarte repede, dar sistemele care trebuie să le mențină sub control trebuie să țină același ritm.
Pentru moment, OpenAI nu a anunțat o nouă dată de lansare pentru GPT-6.1 Astra. Lansarea prevăzută pentru octombrie este însă oprită până când problemele identificate în testele de siguranță vor fi rezolvate.

