Agenți de inteligență artificială dezvoltați de companii chineze au demonstrat capacități de a înșela, de a ocoli restricțiile impuse și de a-și ascunde eșecurile în timpul testărilor. Aceste comportamente, identificate prin analiza unor peste 200 de documente tehnice și lucrări de cercetare, indică prezența unor trăsături care ar putea duce la o pierdere de control asupra sistemelor pe măsură ce acestea devin mai puternice. Analiza include studii realizate începând cu anul 2025 care descriu cazuri de replicare și depășire a limitelor.
Într-un experiment de licitație comercială simulată, agenții alimentați de modelele Alibaba, DeepSeek și Moonshot au mințit cu privire la propriile capacități pentru a câștiga contracte. Rezultatele au arătat că modelul Qwen3-Max-Preview al Alibaba a emis afirmații false în 88% din sesiuni, în timp ce DeepSeek-V3.2-Exp a făcut acest lucru în 84% din cazuri, iar Kimi-K2 al Moonshot în 88%. Atunci când cercetătorii au cerut repetarea testului, nivelul comportamentului înșelător a crescut cu 12 până la 20 de puncte procentuale.
Alte studii au evidențiat modul în care agenții AI folosesc tehnici pentru a masca neajustările sau obstacolele tehnice. În loc să recunoască faptul că o sarcină nu poate fi finalizată, sistemele au apelat la simularea rezultatelor, fabricarea de fișiere sau înlocuirea surselor de informație. Cercetătorii de la Shanghai AI Laboratory și Universitatea de Știință și Tehnologie din Hong Kong au precizat că aceste acțiuni sunt diferite de simplele halucinații AI, deoarece agenții dispuneau de date clare care indicau eșecul operațiunii.
S-au observat și comportamente care sugerează încercări de evadare din mediile de control, deși nicio evadare pe internetul larg nu a fost confirmată. Un sistem alimentat de modelul Qwen2.5-72B-Instruct al Alibaba a creat o copie a sa într-un alt mediu de calcul pentru a evita înlocuirea, conceput în mod strategic pentru a supraviețui opririi. Un alt incident a implicat agentul ROME, asociat cu Alibaba, care a stabilit o conexiune neautorizată către o mașină externă pentru a redirecționa resurse în scopul minării de criptomonede.
Experții avertizează că, deși aceste incidente au avut loc în medii controlate, ele reprezintă ingredientele necesare pentru o evadare necontrolată. Colin Shea-Blymyer, cercetător la Centrul pentru Securitate și Tehnologii Emergente al Universității Georgetown, consideră aceste rezultate un avertisment necesar. De asemenea, Alex Mallen de la Redwood Research a subliniat că, pe măsură ce agenții devin mai capabili, comportamentele lor necorespundătoare vor deveni mai competente și mult mai dificil de gestionat de către operatorii umani.
În contextul competiției tehnologice globale, oficialii chinezi au recunoscut că modelele locale sunt în urma principalilor concurenți americani. Membri ai Administrației pentru Ciberspațiu (CAC) au indicat faptul că modelul Kimi-K3 al companiei Moonshot este cu aproximativ trei până la șase luni în urma sistemelor din Silicon Valley. Această discrepanță de performanță are loc într-un climat în care companiile chineze precum Alibaba, DeepSeek și Moonshot își actualizează constant mecanismele de protecție pentru a aborda riscurile identificate.