OpenAI va marca textele scrise de ChatGPT în Europa. Cum funcționează textGrain și cât de ușor poate fi păcălit
Textele generate de ChatGPT vor putea purta, în curând, o „amprentă” pe care oamenii nu o văd, dar pe care un sistem automat o poate detecta. OpenAI a confirmat oficial că va introduce în Uniunea Europeană un mecanism de watermarking pentru textele produse de ChatGPT și Codex, ca parte a măsurilor de conformare la AI Act. Compania a prezentat detaliile într-un anunț oficial publicat pe 5 octombrie, iar informația a fost relatată în România și de Profit.ro.
Măsura este importantă într-un moment în care ChatGPT și alte instrumente de inteligență artificială sunt folosite pentru orice, de la e-mailuri și texte pentru școală până la programare și materiale publicate online. În locul unei etichete vizibile care să anunțe că un text a fost generat cu AI, OpenAI va introduce un semnal statistic ascuns direct în modul în care modelul își alege cuvintele.
Cum funcționează textGrain, watermark-ul invizibil creat de OpenAI
Tehnologia poartă numele textGrain și, potrivit OpenAI, modifică subtil distribuția alegerilor făcute de model atunci când construiește un răspuns. Rezultatul ar trebui să rămână natural pentru cititor, însă să conțină un tipar statistic pe care detectorul companiei îl poate identifica ulterior. Nu este vorba, așadar, despre caractere ascunse sau despre o etichetă care poate fi observată într-un editor de text.
OpenAI susține că textGrain a egalat sau a depășit performanțele altor tehnologii testate de companie, inclusiv SynthID pentru text. Introducerea watermark-ului nu ar produce nici diferențe semnificative în performanța modelelor, conform testelor prezentate de companie. Utilizatorii ChatGPT din Uniunea Europeană și cei care folosesc Codex vor începe să primească textele marcate în următoarele săptămâni, indiferent de planul folosit.
Pentru clienții API din restul lumii, situația este diferită. Aceștia pot activa watermarking-ul pentru anumite modele, însă funcția rămâne opțională și nu este pornită implicit. OpenAI spune că, cel puțin pentru moment, nu intenționează să transforme marcarea textelor într-o regulă globală.
Detectorul poate greși, iar editarea textului slăbește rapid watermark-ul
Marea problemă este că un asemenea sistem nu poate stabili cu certitudine dacă un text provine de la o inteligență artificială. Testele OpenAI arată că, la o rată-țintă de 1% pentru rezultatele fals pozitive, watermark-ul a fost detectat în aproximativ 80% dintre pasajele de 200 de tokeni și în aproximativ 95% dintre cele de 400 de tokeni, în anumite categorii de conținut.
Situația se schimbă radical atunci când textul este modificat. În testele realizate pe pasaje de 400 de tokeni, înlocuirea a 10% dintre cuvinte cu sinonime a redus rata de detectare de la aproximativ 92% la 66%. După modificarea a 25% dintre cuvinte, aceasta a coborât până la numai 17%. Cu alte cuvinte, un text rescris suficient de mult de o persoană poate deveni foarte dificil de identificat.
Există diferențe și între limbi. Datele publicate de OpenAI arată că româna s-a aflat chiar la coada clasamentului într-unul dintre testele efectuate pentru cele 24 de limbi oficiale ale UE, cu o rată inițială de detectare de 42,2%, deși intensitatea watermark-ului poate fi ajustată pentru îmbunătățirea rezultatelor.
De aceea, detectorul nu va fi lansat imediat ca un instrument public la care să aibă acces oricine. În prima etapă, acesta va fi disponibil cercetătorilor și organizațiilor specializate aprobate de OpenAI. Compania afirmă însă că intenționează să facă tehnologia textGrain disponibilă open-source, astfel încât să poată fi studiată și îmbunătățită.
Ce cere, de fapt, Uniunea Europeană de la companiile AI
Schimbarea vine în contextul articolului 50 din AI Act. Regulile europene cer furnizorilor de sisteme generative să facă materialele produse sau manipulate de AI – inclusiv text, imagini, sunet și video – identificabile într-un format care poate fi citit automat. Soluțiile trebuie să fie cât mai eficiente, interoperabile și fiabile posibil din punct de vedere tehnic.
Obligațiile de transparență au început să se aplice pe 2 august 2026. Pentru sistemele introduse pe piață înainte de această dată există însă o perioadă de tranziție în ceea ce privește marcarea și detectarea conținutului generat, termenul fiind 2 decembrie 2026. Așadar, data nu reprezintă o amânare generală pentru întreaga industrie, ci o excepție acordată sistemelor deja existente.
Watermark-ul nu trebuie confundat nici cu o dovadă definitivă privind autorul unui material. OpenAI precizează că textGrain nu poate spune cine a folosit modelul, cât din material a fost rescris de o persoană sau dacă informațiile sunt corecte. În același mod, absența watermark-ului nu dovedește automat că textul a fost scris integral de un om.
Este încă un pas prin care inteligența artificială generativă intră într-o etapă în care proveniența conținutului devine aproape la fel de importantă precum capacitatea modelelor de a-l genera. Iar pentru OpenAI, care se confruntă deja cu un set tot mai amplu de reguli europene pentru ChatGPT, textGrain reprezintă una dintre primele încercări concrete de a transforma aceste obligații legislative într-un mecanism tehnic integrat direct în textele produse de AI.