Spre deosebire de o marcă vizibilă, precum un logo sau un mesaj adăugat la finalul unui text, sistemul OpenAI modifică statistic modul în care modelul selectează cuvintele. Rezultatul este un semnal care nu poate fi observat de cititor, dar care poate fi căutat ulterior cu ajutorul unui detector special. Ce este, de fapt, marca de apă textGrain În timpul generării unui răspuns, un model de inteligență artificială alege succesiv cuvinte sau fragmente de cuvinte, numite tokeni. textGrain ajustează într-un mod controlat aceste alegeri, astfel încât rezultatul să conțină un tipar statistic asociat modelului OpenAI. Detectorul poate analiza ulterior textul pentru a verifica dacă acest tipar este prezent. OpenAI precizează că sistemul nu adaugă caractere ascunse, spații invizibile sau semne de punctuație neobișnuite. Marca este integrată în însăși alegerea cuvintelor. Pentru utilizator, textul ar trebui să arate și să se comporte ca un text obișnuit. OpenAI susține că testele sale nu au identificat diferențe semnificative de performanță ale modelului cu și fără marca de apă.

De ce apare această schimbare în Uniunea Europeană Măsura vine în contextul aplicării obligațiilor de transparență prevăzute de AI Act. Articolul 50 stabilește cerințe privind marcarea și identificarea conținutului generat de inteligența artificială, iar obligațiile relevante se aplică, în general, din 2 august 2026. OpenAI a ales o implementare etapizată. În prima fază, marca de apă va fi introdusă în textele eligibile generate de ChatGPT și Codex în Uniunea Europeană, pentru toate planurile. În schimb, pentru clienții care folosesc API-ul OpenAI, funcția poate fi activată la nivel global pentru anumite modele, însă rămâne dezactivată implicit. Compania nu intenționează, cel puțin la început, să transforme marcarea textelor într-o setare implicită la nivel mondial. Marca de apă nu arată cât a scris omul și nu identifică utilizatorul Un aspect important este că identificarea unei mărci OpenAI nu înseamnă că detectorul poate stabili cine a scris textul sau cât de mult a contribuit o persoană la redactarea lui.

OpenAI precizează că marca de apă: - nu identifică utilizatorul; - nu dezvăluie conversația sau promptul folosit; - nu stabilește autorul legal al textului; - nu arată cât din material a fost generat de inteligența artificială; - nu demonstrează că informația din text este adevărată. Prin urmare, un rezultat pozitiv al detectorului ar trebui interpretat ca un indiciu că un model OpenAI a generat sau a procesat conținutul, nu ca o dovadă completă privind autorul materialului. Cât de sigură este detectarea unui text generat de ChatGPT Tehnologia are încă limite importante. În testele prezentate de OpenAI, la o rată-țintă de fals pozitive de 1%, detectorul a identificat marca în aproximativ 80% dintre textele de 200 de tokeni și în aproximativ 95% dintre cele de 400 de tokeni în anumite domenii. Performanța variază însă în funcție de tipul textului. În domenii precum matematica, unde există mai puțină libertate în alegerea cuvintelor, detectarea este mai dificilă. Există și o diferență importantă în funcție de limbă. Potrivit datelor publicate de OpenAI, în testele sale, rata de detectare pentru limba română a fost de 42,2% la o rată de fals pozitive de 1%, înainte de ajustarea suplimentară a intensității semnalului pentru limbile cu rezultate mai slabe.

Ce se întâmplă dacă textul este modificat Marca de apă nu este imposibil de afectat prin editarea textului. OpenAI arată că reformulările, înlocuirea cuvintelor sau traducerea pot reduce capacitatea detectorului de a identifica semnalul. Într-unul dintre testele companiei, pentru texte de aproximativ 400 de tokeni în limba engleză, înlocuirea a 10% dintre cuvinte cu sinonime a redus rata de detectare de la aproximativ 92% la 66%. Înlocuirea a 25% dintre cuvinte a redus-o la aproximativ 17%. Asta înseamnă că nici detectarea unei mărci, nici absența ei nu pot fi considerate, în prezent, o metodă infailibilă pentru stabilirea originii unui text. Cine va putea verifica marca de apă OpenAI nu va pune detectorul la dispoziția publicului larg la momentul lansării. Compania intenționează să acorde inițial acces cercetătorilor și organizațiilor specializate, pe bază de aprobare. Decizia este legată inclusiv de riscul apariției unor rezultate greșite. Un detector poate identifica o marcă acolo unde aceasta nu există sau poate să nu detecteze o marcă prezentă în text. Pentru moment, instrumentul va indica dacă a fost identificată o marcă asociată OpenAI, fără să ofere informații despre utilizator, prompturi sau conversații.

Ce trebuie să știe utilizatorii ChatGPT din România Pentru utilizatorii din România, schimbarea este relevantă deoarece România face parte din Uniunea Europeană. Textele eligibile generate de ChatGPT și Codex vor intra, în următoarele săptămâni, în sistemul de marcare invizibilă anunțat de OpenAI. Este important însă ca această schimbare să nu fie confundată cu apariția unui mesaj vizibil de tipul „Acest text a fost generat de AI”. Marca de apă este destinată în primul rând identificării de către sisteme software, nu afișării unei etichete cititorului. Ce urmează pentru marcarea conținutului generat de AI OpenAI spune că intenționează să își reevalueze abordarea pe măsură ce tehnologia și standardele de identificare a conținutului generat de AI evoluează. În paralel, compania intenționează să pună tehnologia textGrain la dispoziția comunității în regim open-source, iar accesul la detector va fi extins ulterior în funcție de rezultatele evaluărilor și de evoluția standardelor europene. Pentru utilizatorii europeni, schimbarea marchează însă un moment important: textele generate de cele mai populare sisteme de inteligență artificială încep să primească mecanisme tehnice prin care originea lor poate fi verificată, chiar dacă aceste mecanisme nu sunt încă perfecte.