ChatGPT va pune watermark invizibil în textele generate în UE. Ce înseamnă, de fapt

Publicat: 06 oct. 2026, 14:34, de Radu Caranfil, în TEHNOLOGIE , ? cititori
ChatGPT va pune watermark invizibil în textele generate în UE. Ce înseamnă, de fapt
un watermark blajin

OpenAI va introduce, în următoarele săptămâni, un watermark invizibil în anumite texte generate de ChatGPT și Codex pentru utilizatorii din Uniunea Europeană. Măsura vine în contextul cerințelor de transparență din AI Act și încearcă să facă textele generate de inteligența artificială identificabile automat.

Important: nu va apărea nicio etichetă de tip „scris de ChatGPT”.

Sistemul, numit textGrain, introduce un semnal statistic în modul în care modelul alege cuvintele.

Un detector special poate căuta ulterior acest tipar și poate estima dacă un pasaj conține watermarkul OpenAI.

Nu este o probă definitivă

Tehnologia are însă limite serioase.

În testele OpenAI, la o rată-țintă de 1% rezultate fals pozitive, watermarkul a fost detectat în aproximativ 80% dintre textele de 200 de tokeni* și în circa 95% dintre cele de 400 de tokeni, în anumite categorii de conținut.

Dar editarea textului reduce rapid precizia: înlocuirea a 25% dintre cuvinte cu sinonime a coborât rata de detectare până la 17%.

Asta înseamnă că watermarkul nu poate funcționa ca un „test ADN” al unui articol.

OpenAI precizează explicit că el nu poate arăta cât din text a fost scris de un om și cât de AI.

Nu identifică utilizatorul, contul, conversația sau promptul.

Nu stabilește cine este autorul ori cine poartă responsabilitatea pentru conținut.

Nici absența watermarkului nu demonstrează că un text este uman: acesta poate fi prea scurt, editat, tradus sau generat de un alt sistem.

Detectorul nu va fi public

Cel puțin inițial, instrumentul de detectare NU va fi oferit publicului larg. Accesul va fi acordat cercetătorilor și unor organizații specializate aprobate de OpenAI.

Pe scurt, UE cere inteligenței artificiale să lase urme în text.

Dar, deocamdată, sunt mai degrabă niște amprente statistice fragile decât o ștampilă sigură cu „acest material a fost scris de AI”.

*Tokenii sunt bucățile mici în care modelul descompune textul când îl procesează: pot fi cuvinte întregi, fragmente de cuvinte, semne de punctuație sau combinații de caractere.
De aceea, 200 de tokeni nu înseamnă exact 200 de cuvinte; de regulă, textul va avea mai puține cuvinte decât tokeni.

Watermarkul devine mai ușor de detectat pe texte mai lungi tocmai fiindcă are mai multe astfel de „alegeri statistice” de analizat.