Compania Anthropic a anunțat că modelul său de inteligență artificială, Claude, va juca un rol central în procesul de dezvoltare a următorului model de AI. În prezent, Claude coordonează 26% din activitatea de cercetare și dezvoltare a companiei, demonstrând capacitatea de a gestiona sarcini complexe de la început până la sfârșit, pornind de la instrucțiuni de nivel înalt, dar rămânând sub supravegherea umană.
În prezent, aproximativ 90% din activitatea de cercetare și dezvoltare a companiei se desfășoară într-o formă de colaborare cu Claude. Această interacțiune permite modelului să realizeze volume mari de muncă, însă sub îndrumarea atentă a oamenilor. Compania subliniază că modelul nu funcționează încă într-un mod complet autonom, fiind necesară intervenția constantă pentru a asigura controlul asupra proceselor de inginerie.
Anunțul vine într-un moment în care lideri precum CEO-ul Anthropic, Dario Amodei, solicită o încetinire a ritmului de dezvoltare a tehnologiei din motive de siguranță. Compania a subliniat necesitatea de a reduce decalajul dintre cunoștințele laboratoarelor de vârf și cele ale publicului. Acest lucru implică o raportare publică mai transparentă pentru a permite societății să decidă modul de utilizare a informațiilor.
Riscul major identificat de Anthropic este că modelele care își accelerează propria dezvoltare pot face ca controlul uman să devină mult mai dificil. Partajarea indicatorilor de progres este esențială pentru a monitoriza cât de aproape sunt laboratoarele de conceptul de autoîmbunătățire recursivă. Aceasta reprezintă capacitatea unui model de a-și construi, în mod autonom, succesorul, un proces care necesită monitorizare strictă.
Pentru a asigura siguranța, compania a raportat că în luna august, aproximativ 30.000 de agenți desfășurau activități de cercetare și inginerie. Măsurile de supraveghere sunt vitale pentru a detecta frecvența comportamentelor necorespunzătoare ale agenților. În acest scop, Anthropic s-a angajat să integreze evaluatori externi independenți în cadrul proceselor de monitorizare a eforturilor de siguranță.
Evoluția tehnologiei de inteligență artificială și riscurile asociate sunt subiecte de interes global, în timp ce tensiunile geopolitice rămân un factor de instabilitate. De exemplu, discuțiile despre securitatea transporturilor de cereale în Marea Neagră sau tacticile de război utilizate în conflictele actuale subliniază importanța stabilității în infrastructura globală. Întreg cadrul de siguranță al tehnologiilor emergente este analizat constant în contextul riscurilor de securitate internațională.