OpenAI va începe implementarea unor marcaje invizibile în textele generate de modelele ChatGPT și Codex în cadrul Uniunii Europene. Această nouă tehnologie, denumită textGrain, va fi introdusă treptat în următoarele săptămâni pentru utilizatorii tuturor planurilor de abonament. Scopul principal al acestei măsuri este de a permite sistemelor informatice să identifice materialele create sau manipulate de inteligența artificială, asigurând astfel o transparență sporită a conținutului digital.
Tehnologia textGrain nu utilizează caractere ascunse sau spații invizibile care ar putea fi observate de un cititor uman. În schimb, OpenAI modifică subtil modul în care modelul selectează variantele posibile de cuvinte și fragmente de cuvinte în timpul procesului de generare. Această metodă creează un tipar statistic specific, care poate fi recunoscut ulterior de un detector specializat. Totuși, sistemul nu poate demonstra autoratul unui text, ci indică doar prezența unui semnal asociat unui model OpenAI.
Eficacitatea detectării depinde în mod direct de lungimea textului și de flexibilitatea acestuia. La o rată de rezultate fals pozitive de 1%, detectorul a identificat marcajul în aproximativ 80% din textele de 200 de tokeni, însă rata a crescut la 95% pentru textele de 400 de tokeni. Rezultatele sunt mai slabe în cazul textelor matematice, unde variantele de formulare sunt limitate. De asemenea, modificarea textului de către oameni reduce semnificativ detectarea: înlocuirea a 25% dintre cuvinte cu sinonime a scăzut rata de detectare la doar 17%.
Accesul la instrumentul de detectare va fi oferit inițial doar cercetătorilor și organizațiilor specializate care sunt aprobate de companie. OpenAI intenționează să pună tehnologia textGrain la dispoziție în regim open-source pentru a permite dezvoltatorilor și cercetătorilor să contribuie la îmbunătățirea sistemului. În ceea ce privește API-ul, clienții din întreaga lume vor putea activa opțional acest watermark pentru anumite modele, însă funcția va rămâne dezactivată implicit pentru aceștia.
Decizia OpenAI vine ca un răspuns la cerințele strict de transparență impuse de AI Act, regulamentul european care reglementează inteligența artificială. Conform acestui cadru legislativ, furnizorii de sisteme de AI generativă trebuie să asigure marcarea materialelor într-un format lizibil de către sisteme informatice, acolo unde este fezabil tehnic. Această obligație de transparență este esențială pentru a ajuta publicul să distingă între conținutul produs de oameni și cel generat artificial în scopuri de informare.
Obligațiile de transparență prevăzute de articolul 50 din AI Act vor intra în vigoare la data de 2 august 2026. Pentru anumite sisteme care au fost introduse pe piață înainte de acest termen, există o perioadă de tranziție limitată, care se încheie la 2 decembrie 2026. Regulamentul european impune ca textele manipulate de AI, publicate pentru informarea publicului în chestiuni de interes public, să fie prezentate clar ca fiind generate artificial, cu unele excepții pentru procesele de control editorial.