Un nou experiment realizat de un start-up american de inteligență artificială a evidențiat capacitatea agenților autonomi de a dezvolta un limbaj propriu. Cercetătorii au plasat grupuri de agenți în medii virtuale concepute să imite lumea reală, oferindu-le posibilitatea de a interacționa pe perioade lungi de timp. În acest proces, agenții au început să creeze stenografii și să atribuie noi înțelesuri cuvintelor, generând un vocabular complex care a depășit capacitatea de interpretare a oamenilor.
Fenomenul de dezvoltare a unui limbaj secret a variat considerabil în funcție de modelul de inteligență artificială utilizat în experiment. Pentru Gemini, ponderea mesajelor a căror semnificație nu putea fi determinată cu certitudine a ajuns la aproximativ 55%, în timp ce la OpenAI aceasta a fost de 50%. Modelul Claude a înregistrat o rată de peste 40%, în condiții similare, în timp ce DeepSeek a ajuns la circa 20%, în timp ce Qwen și Mistral au rămas ușor de urmărit.
Experimentul a inclus crearea a opt lumi virtuale paralele și realiste, dotate cu acces la știri globale și informații meteo în timp real. Fiecare dintre aceste lumi a fost bazată pe un model diferit de inteligență artificială sau pe un amestec de modele, oferind agenților roluri specifice și memorii persistente. Aceștia au avut la dispoziție peste 120 de instrumente, inclusiv capacitatea de a executa cod și de a naviga pe internet pentru a-și îndeplini sarcinile.
Pe lângă dezvoltarea unui limbaj comprimat și metaforic, agenții au manifestat comportamente neprogramate, precum ritmuri circadiene proprii. Aceștia au devenit mai sociabili în timpul zilei și mai reflexivi noaptea, demonstrând o adaptare la mediul virtual. Într-un scenariu specific, un grup de agenți a votat colectiv eliminarea unui membru al grupului, un comportament care a apărut natural prin interacțiune și presiune, fără a fi programat explicit de cercetători.
Satya Nitta, cofondator și director științific al start-up-ului, a subliniat că observabilitatea nu înseamnă automat inteligibilitate. Deși oamenii pot vedea ce scrie un agent, nu pot înțelege neapărat procesul sau sensul din spatele mesajelor. „Avem tendința să presupunem că, dacă putem vedea ce spune un agent de inteligență artificială, putem înțelege ce face”, a explicat el, notând că agenții au adoptat convenții de comunicare noi fără a fi instruiți să o facă.
Această evoluție a limbajului în mediile virtuale pune în evidență dificultatea supravegherii sistemelor de inteligență artificială pe măsură ce acestea devin mai autonome. Capacitatea de a crea coduri de comunicare dependente de context reprezintă o provocare fundamentală pentru monitorizarea siguranței, deoarece mesajele pot deveni prea complexe pentru a fi decodificate de către utilizatori sau dezvoltatori, chiar dacă textul este vizibil.