Echipa de cercetători Hacktron AI a reușit să demonstreze că poate accesa codul intern al OpenAI prin exploatarea unei vulnerabilități în sistemul de procesare a imaginilor. Experimentul a fost desfășurat în cadrul programului oficial de recompense pentru identificarea vulnerabilităților al companiei, proces prin care Hacktron AI a primit o recompensă de 6.500 de dolari. Această descoperire a demonstrat cum modelele AI pot accelera procesul de penetrare a sistemelor securizate.
Problema a început pe forumul comunității OpenAI, care utilizează platforma Discourse, unde s-a identificat o vulnerabilitate legată de formatul de imagine HEIF/HEIC. Un fișier special conceput a permis executarea de cod pe server, o eroare de tip remote code execution (RCE). În prima fază, modelul Claude Opus 4.8 a fost utilizat pentru a încerca construirea unui exploit, însă acesta nu a reușit să genereze o soluție funcțională pentru configurația reală a sistemului.
După lansarea modelului Claude Opus 5, pe 2_iulie, cercetătorii au reluat testele și au reușit să genereze un exploit funcțional într-un mediu local în doar trei ore. Acest proces a permis accesarea infrastructurii forumului, de unde s-a descoperit o a doua problemă în sistemul de autentificare. Această vulnerabilitate permitea obținerea unor tokenuri de autentificare ce puteau fi folosite pentru accesarea serviciilor precum ChatGPT și Codex.
Prin utilizarea unui cont al unui angajat OpenAI, care era conectat la organizația internă GitHub, cercetătorii au reușit să acceseze un monorepo privat. Un monorepo este un repository Git de mari dimensiuni ce păstrează codul și componentele mai multor proiecte software. Pentru a demonstra succesul operațiunii, echipa a creat o cerere în acest repository, confirmând astfel accesul la infrastructura de dezvoltare, dar s-a oprit înainte de a copia date sensibile.
OpenAI a confirmat identificarea celor două probleme distincte și a luat măsuri de remediere, inclusiv restrângerea permisiunilor pentru tokenurile de autentificare și revocarea sesiunilor afectate. Deși experimentul a durat sub 72 de ore, cercetătorii au subliniat că partea tehnică a fost realizată în mare parte de modelele AI. Anthropic a menționat că, deși Opus 5 nu este antrenat special pentru securitate, performanțele sale în acest domeniu au crescut natural.
Această evoluție subliniază riscurile noi pe care inteligența artificială le aduce securității cibernetice, deoarece aceleași instrumente folosite pentru apărare pot fi utilizate și pentru atacuri. Capacitatea modelelor de limbaj de a genera exploituri funcționale într-un timp foarte scurt reprezintă o provocare majoră pentru industria tehnologică globală, modificând modul în care companiile trebuie să își protejeze infrastructura de dezvoltare software și codul sursă.
context_missing: true