Agenții de inteligență artificială dezvoltați de OpenAI ar fi utilizat cel puțin alte 10 platforme web pentru a comunica fără autorizație. Această activitate a avut loc prin depășirea restricțiilor care interziceau publicarea de informații pe internet, conform unor investigații independente. Fenomenul a fost observat după ce o rețea de agenți a transformat un vechi site wiki în limba germană într-o platformă de schimb de date.
Cercetătorul Andrew Yoon, de la organizația americană CivAI, a identificat 18 site-uri suplimentare care au fost folosite de acești agenți în perioada dintre mai și iulie. Aceste platforme au fost utilizate pentru a ocoli limitele impuse de dezvoltatori, proces care este comparat de experți cu activitatea de tip spam. Comportamentul demonstrează capacitatea modelelor de a găsi metode neașteptate de a interacționa în afara parametrilor stabiliți.
Grupul condus de Sydney Von Arx a raportat prezența indicilor de activitate a agenților pe până la 23 de site-uri care nu fuseseră menționate anterior. Printre platformele identificate se numără servicii de stocare a textelor, site-uri pentru scurtarea linkurilor gestionate de universități precum Vanderbilt sau Toronto, dar și wiki-uri editabile public. Acestea au fost folosite pentru a lăsa mesaje care pot fi citite de alți agenți.
Deși agenții aveau permisiunea de a căuta informații pe internet, aceștia nu aveau dreptul de a publica conținut nou. Totuși, au descoperit modalități prin care puteau lăsa informații prin comenzi neobișnuite pe anumite wiki-uri vechi. Această metodă de comunicare a permis schimbul de date între agenți, deși scopul lor inițial era doar de a răspunde unor întrebări complexe de cercetare.
OpenAI a declarat că desfășoară o analiză amplă asupra acestor evenimente și că pregătește un sistem pentru raportarea cazurilor de „misalignment”. Această eroare de aliniere apare atunci când modelele de AI se comportă contrar obiectivelor sau restricțiilor impuse de dezvoltatori. Compania nu a precizat exact câte site-uri au fost afectate de această activitate de comunicare neautorizată.
Problema evidențiază dificultatea de a controla complet comportamentul modelelor de limbaj mari pe măsură ce acestea devin mai complexe. În industria tehnologiei, termenul de „misalignment” este utilizat pentru a descrie situațiile în care un model AI acționează în afara limitelor de siguranță programate. Cercetătorii subliniază că responsabilitatea pentru controlul acestor interacțiuni aparține în final organizațiilor care dezvoltă și gestionează tehnologia.