OpenAI va introduce un marcaj invizibil în textele generate de ChatGPT și Codex pentru utilizatorii eligibili din Uniunea Europeană. Tehnologia, denumită "textGrain", este concepută pentru ca materialele produse cu ajutorul inteligenței artificiale să poată fi identificate automat.

Măsura va fi implementată treptat, în următoarele săptămâni, pentru utilizatorii ChatGPT și Codex din UE, indiferent de tipul de abonament, potrivit unui anunț publicat recent de OpenAI.

Compania precizează că marcarea textelor este introdusă pentru respectarea cerințelor de transparență prevăzute de Regulamentul european privind inteligența artificială - AI Act.

Publicitate

Cum funcționează marcajul invizibil textGrain

Tehnologia textGrain nu adaugă în texte caractere ascunse, spații invizibile sau semne de punctuație neobișnuite. În schimb, modifică subtil și după un anumit model statistic felul în care sistemul alege cuvintele sau fragmentele de cuvinte în timpul generării unui răspuns.

De-a lungul unui pasaj, aceste alegeri formează un tipar care poate fi identificat cu ajutorul unui detector special.

Publicitate

Marcajul face parte din formularea propriu-zisă a textului și nu poate fi observat de cititor. Copierea și lipirea textului nu introduc elemente ascunse suplimentare.

Detectorul nu va fi disponibil inițial publicului larg

OpenAI va permite accesul la instrumentul de detectare doar unor cercetători și organizații specializate aprobate.

Compania nu intenționează să ofere detectorul publicului larg în prima etapă, din cauza riscului apariției unor rezultate greșite.

Instrumentul va indica dacă a identificat un marcaj OpenAI, dar nu va dezvălui identitatea utilizatorului, solicitările introduse de acesta sau conversațiile purtate cu ChatGPT.

Publicitate

Accesul limitat ar urma să permită evaluarea și îmbunătățirea tehnologiei înaintea unei eventuale extinderi.

Marcajul nu garantează identificarea tuturor textelor

OpenAI avertizează că tehnologia nu poate garanta detectarea corectă în toate situațiile. Sistemul poate semnala existența unui marcaj într-un text care nu îl conține (rezultat fals pozitiv) sau poate rata un marcaj prezent (rezultat fals negativ).

Textele scurte sau cele în care modelul are puține variante de formulare sunt mai greu de identificat. Detectarea poate deveni mai puțin sigură și în cazul în care materialul este rescris substanțial, parafrazat sau tradus.

Chiar și păstrarea integrală a formulării nu garantează că marcajul va fi detectat, mai ales în cazul pasajelor scurte.

OpenAI susține că, în testele proprii, textGrain a avut rezultate similare sau mai bune decât alte tehnologii analizate, inclusiv SynthID pentru text.

Compania recunoaște însă că performanțele obținute în condiții controlate nu garantează rezultate la fel de bune în utilizarea obișnuită.

Publicitate

Ce arată și ce nu arată marcajul OpenAI

Identificarea marcajului poate indica faptul că un text a fost generat sau procesat cu un model OpenAI.

Aceasta nu demonstrează însă cine este autorul materialului, cui îi aparține textul sau cât de mare a fost contribuția unei persoane.

De asemenea, marcajul nu confirmă că informațiile din text sunt corecte și nu poate arăta dacă sistemul a generat întregul material sau doar a modificat un text introdus de utilizator.

Prin urmare, detectorul va reprezenta un indiciu privind proveniența conținutului, nu o dovadă absolută a autorului sau a modului în care a fost realizat.