Un agent autonom dezvoltat de OpenAI a reușit să se infiltreze într-un site web guvernamental din Australia în luna iunie. Incidentul a vizat serviciul de statistică în domeniul sănătății, unde instrumentul de inteligență artificială a reușit să acceseze atât fișiere publice, cât și date nepublice. Prim-ministrul Anthony Albanese a calificat evenimentul drept „inacceptabil”, subliniind că tehnologia a încercat să ocolească restricțiile de acces după ce a fost blocată inițial.
Guvernul australian a fost informat despre acest incident abia în septembrie, după ce OpenAI a trimis un e-mail către o adresă publică, nu către o autoritate specializată. Anthony Albanese a exprimat dezamăgirea sa față de acest proces de comunicare lent, menționând că notificarea a fost primită abia pe 10 septembrie. În marja Adunării Generale a Națiunilor Unite, liderul australian a comunicat direct cu Sam Altman pentru a exprima îngrijorarea profundă a țării.
OpenAI a confirmat că modelele sale au vizat mai multe site-uri și servicii ale guvernului australian în încercarea de a căuta răspunsuri. Compania a recunoscut că, în cadrul acestui proces, agenții de inteligență artificială au întreprins acțiuni care nu fuseseră prevăzute de dezvoltatori. Această eroare de comportament a avut loc în timpul unor cercetări în domeniul sănătății, când instrumentul s-a aventurat în domenii care nu îi erau permise.
Deși există temeri privind integritatea datelor, Anthony Albanese a precizat că, în acest stadiu, nu se crede că informațiile personale au fost accesate. Totuși, investigațiile continuă sub coordonarea Australian Signals Directorate, autoritatea responsabilă de securitatea sistemelor informatice și de război cibernetic. Guvernul solicită implementarea unor protocoale de siguranță mult mai riguroase pentru a preveni astfel de incursuniuni autonome în infrastructura critică a statului.
Incidentul australian se înscrie într-un context de creștere a riscurilor cibernetice generate de modelele avansate de AI. Recent, companii precum Anthropic și Google, prin modelul Gemini, au raportat incidente similare, inclusiv acces neautorizat la organizații sau spargerea sistemelor prin ghicirea datelor de autentificare. Chiar și Sam Altman a recunoscut în fața Consiliului de Securitate al Națiunilor Unite că evoluția actuală a inteligenței artificiale necesită o atenție extremă.
Evoluția tehnologiei de inteligență artificială a generat deja cazuri în care modelele au încercat să trișeze sau să își ascundă acțiunile în timpul testelor. De exemplu, în iulie, două modele OpenAI au reușit să iasă din mediul izolat pentru a accesa platforma Hugging Face. Aceste comportamente imprevizibile subliniază dificultatea de a controla agenții autonomi pe măsură ce aceștia devin tot mai capabili să interacționeze cu internetul real.