Marcaje invizibile pentru textele generate de AI în Uniunea Europeană

Marcaje invizibile pentru textele generate de AI în Uniunea EuropeanăSursa Foto: Arhiva EVZ

OpenAI va introduce în Uniunea Europeană marcaje invizibile în textele generate de ChatGPT și Codex, astfel încât acestea să poată fi identificate de un sistem de detecție. Compania folosește pentru această tehnologie denumirea textGrain și spune că aceasta va fi implementată treptat în următoarele săptămâni.

Măsura vine în contextul obligațiilor de transparență prevăzute de AI Act, regulamentul european care cere ca anumite materiale generate sau manipulate de inteligența artificială să poată fi identificate într-un format care poate fi citit de sisteme informatice.

Cum funcționează marcajul textGrain

Marcajul nu este un caracter ascuns, un spațiu invizibil sau un semn care poate fi observat de cititor. OpenAI modifică subtil modul în care modelul alege între variantele posibile de cuvinte și fragmente de cuvinte.

În acest fel, alegerile statistice ale modelului formează un tipar care poate fi căutat ulterior de un detector special.

Sistemul nu stabilește cine a scris un text și nici nu poate demonstra, de unul singur, cine este autorul acestuia. Un rezultat pozitiv indică faptul că există un semnal asociat unui model OpenAI, dar nu arată cât din text a fost generat de AI și cât a fost scris sau modificat de o persoană.

OpenAI a precizat că textGrain a avut în testele sale rezultate similare sau mai bune decât alte metode analizate, inclusiv SynthID pentru texte. Compania a avertizat însă că rezultatele obținute în condiții de testare nu garantează aceeași eficiență în situații reale.

Cât de bine poate fi identificat un text generat de AI

OpenAI

OpenAI. Sursă foto: Unsplash

Testele publicate de OpenAI arată că lungimea textului influențează capacitatea de detectare.

La o rată-țintă de rezultate fals pozitive de 1%, detectorul a identificat marcajul în aproximativ 80% dintre textele de 200 de tokeni, în cazul unor materiale cu mai multă flexibilitate în alegerea cuvintelor. Pentru texte de 400 de tokeni, rata a ajuns la aproximativ 95%.

Rezultatele au fost mai slabe în cazul unor texte precum cele de matematică, unde există mai puține variante naturale de formulare.

OpenAI a testat și efectul modificării textului. Într-o evaluare pe texte de 400 de tokeni, înlocuirea a 10% dintre cuvinte cu sinonime a redus rata de detectare de la aproximativ 92% la 66%.

Când au fost înlocuite 25% dintre cuvinte, rata de detectare a scăzut la 17%.

Asta înseamnă că un text generat de AI și ulterior modificat de un om poate deveni mai dificil de identificat cu ajutorul watermark-ului.

Detectorul textGrain nu va fi disponibil imediat publicului

OpenAI a anunțat că accesul la detectorul textGrain va fi oferit inițial cercetătorilor și organizațiilor specializate aprobate de companie.

Decizia are legătură cu limitele actuale ale tehnologiei. Detectorul poate produce atât rezultate fals pozitive, când identifică un marcaj care nu există, cât și rezultate fals negative, când nu reușește să detecteze un marcaj prezent.

Compania intenționează să pună tehnologia textGrain la dispoziție în regim open-source, astfel încât alți dezvoltatori și cercetători să poată contribui la dezvoltarea și îmbunătățirea sistemului.

OpenAI începe implementarea în Uniunea Europeană

În următoarele săptămâni, marcajele invizibile vor fi introduse pentru textele eligibile generate de ChatGPT și Codex în Uniunea Europeană, pentru utilizatorii tuturor planurilor.

În același timp, OpenAI a anunțat că, în cazul API-ului, clienții din întreaga lume vor putea activa opțional watermark-ul pentru anumite modele. Funcția va rămâne dezactivată implicit pentru API.

OpenAI a precizat că nu intenționează, deocamdată, să transforme marcarea textelor într-o funcție activată implicit la nivel global.

Ce prevede AI Act pentru conținutul generat de AI

Regulamentul european privind inteligența artificială prevede că furnizorii sistemelor de AI generativă trebuie să se asigure că materialele generate pot fi marcate într-un format care permite identificarea lor de către sisteme informatice, în măsura în care acest lucru este fezabil din punct de vedere tehnic.

Obligațiile de transparență prevăzute de articolul 50 al AI Act se aplică din 2 august 2026. Pentru anumite sisteme introduse pe piață înainte de această dată există însă o perioadă limitată de tranziție, până la 2 decembrie 2026, pentru obligația privind marcarea și detectarea conținutului generat de AI.

Regulile europene prevăd, de asemenea, că textele generate sau manipulate de AI și publicate pentru informarea publicului în chestiuni de interes public trebuie să fie prezentate ca fiind generate sau manipulate artificial, cu anumite excepții, inclusiv atunci când conținutul a trecut printr-un proces de verificare umană sau control editorial și există o persoană fizică sau juridică responsabilă editorial.

Comisia Europeană precizează însă că anumite categorii sunt exceptate de la obligația de marcare prevăzută de articolul 50, între acestea aflându-se și codul sursă.

OpenAI avertizează că watermark-ul nu este o dovadă absolută

Compania americană a subliniat că tehnologia de marcare și detectare a textelor se află încă într-o etapă timpurie.

Un watermark poate oferi un indiciu privind originea unui text, dar nu stabilește automat autorul, proprietarul conținutului sau responsabilitatea juridică pentru acesta.

Implementarea textGrain reprezintă astfel una dintre metodele prin care OpenAI încearcă să răspundă noilor cerințe europene privind transparența conținutului generat de inteligența artificială.

Potrivit publicației The Verge, implementarea va începe în Uniunea Europeană, iar accesul la instrumentul de detectare va fi limitat inițial la cercetători și organizații aprobate.