Compania OpenAI va implementa în următoarele săptămâni un sistem de watermark invizibil pentru textele generate de ChatGPT și Codex destinate utilizatorilor din Uniunea Europeană. Această măsură este luată pentru a respecta cerințele europene privind identificarea conținutului creat de inteligența artificială. Tehnologia va funcționa prin inserarea unor semnale statistice în modul în care modelul alege cuvintele, fără a lăsa simboluri sau etichete vizibile pentru cititor.
Sistemul, denumit textGrain, permite utilizarea unui detector special care poate căuta acest semnal ascuns pentru a estima dacă un fragment de text provine de la inteligența artificială. Implementarea va fi realizată etapizat, începând cu data de 5 octombrie, când clienții API din întreaga lume vor putea opta pentru această funcție, deși aceasta va rămâne dezactivată implicit. Pentru utilizatorii eligibili din UE, funcționalitatea va deveni activă în perioada următoare.
Eficacitatea tehnologiei depinde în mare măsură de lungimea și tipul conținutului analizat, conform testelor realizate de OpenAI. La o rată de rezultate fals pozitive de 1%, detectorul a reușit să identifice watermarkul în aproximativ 80% din textele de 200 de tokeni, performanță care crește la 95% pentru pasaje de 400 de tokeni. Totuși, modificarea textului poate compromite procesul de detectare, reducând semnificativ șansele de succes.
Editarea textului reprezintă o provocare majoră pentru sistemul textGrain, deoarece înlocuirea cuvintelor cu sinonime scade drastic rata de detectare. Într-un test pe pasaje de 400 de tokeni, înlocuirea a doar 10% dintre cuvinte a coborât rata de detectare de la 92% la 66%, iar dacă un sfert dintre cuvinte au fost modificate, procentul a scăzut la 17%. Din acest motiv, accesul la detector va fi limitat inițial la cercetători și organizații specializate.
OpenAI subliniază că acest watermark nu poate stabili cu certitudine contribuția umană sau proprietatea asupra unui text. Marcajul nu identifică utilizatorul, contul, organizația sau promptul utilizat, și nici nu garantează corectitudinea informațiilor prezentate. De asemenea, absența unui watermark nu constituie o dovadă că un text a fost scris de un om, deoarece materialele prea scurte, traduse sau modificate pot pierde semnalul statistic.
Această inițiativă vine în contextul reglementărilor europene stricte privind inteligența artificială, care impun furnizorilor de tehnologii generative să facă conținutul identificabil automat. EU AI Act obligă companiile să asigure transparența proceselor de generare, astfel încât utilizatorii să poată distinge între conținutul creat de oameni și cel produs de algoritmi, într-un cadru de reglementare care continuă să evolueze constant.