OpenAI anunță că va marca invizibil textele generate de ChatGPT, conform regulilor UE
Ce confirmă toate sursele
- OpenAI va marca textele generate de AI în Uniunea Europeană prin marcaje invizibile numite textGrain.
- Marcajele se vor aplica atât textelor simple, cât și codului generat de instrumentele de programare ale OpenAI.
Actualizări
- Marcajul ajunge la utilizatorii ChatGPT și Codex din UE în următoarele săptămâni; din 5 octombrie, clienții API din toată lumea îl pot activa opțional.
- Deocamdată, detectorul nu este public: are acces doar cercetătorii și organizațiile aprobate de OpenAI.
- Au fost publicate cifre detaliate de detectare: 80% la 200 de tokeni, 95% la 400 de tokeni și 17% după înlocuirea unui sfert dintre cuvinte cu sinonime.
- Marcajul nu identifică utilizatorul sau contul, iar lipsa lui nu dovedește că un text a fost scris de un om.
Textele generate de ChatGPT vor purta marcaje invizibile, astfel încât să poată fi deosebite de cele scrise de oameni. OpenAI a anunțat măsura ca să respecte cerințele Uniunii Europene privind identificarea conținutului generat de AI. Sistemul se numește textGrain și se va aplica atât textelor simple, cât și codului produs de instrumentele de programare ale companiei. Pentru utilizatorii eligibili ChatGPT și Codex din UE, marcajul urmează să fie introdus în următoarele săptămâni. Inițial, implementarea se limitează la Uniunea Europeană.
Din 5 octombrie, clienții API ai OpenAI din toată lumea pot activa marcajul pentru anumite modele. Funcția este dezactivată implicit.
textGrain este un semnal statistic invizibil, introdus prin felul în care modelul alege cuvintele. Un detector special îl poate căuta ulterior. Conform anunțului inițial, OpenAI urma să pună detectorul la dispoziție sub licență open-source. Compania precizează însă că, deocamdată, detectorul nu va fi public: accesul va fi acordat la început cercetătorilor și organizațiilor specializate aprobate de OpenAI.
OpenAI susține că textGrain funcționează mai bine decât alte sisteme de marcare, dar recunoaște că nu poate garanta o identificare perfectă. Cu o rată-țintă de 1% rezultate fals pozitive, detectorul a identificat marcajul în aproximativ 80% dintre textele de 200 de tokeni din anumite categorii și în aproximativ 95% dintre pasajele de 400 de tokeni. Rata scade când textul este modificat de oameni. În testele companiei pe pasaje de 400 de tokeni, înlocuirea a 10% dintre cuvinte cu sinonime a redus detectarea de la aproximativ 92% la 66%, iar înlocuirea unui sfert dintre cuvinte a coborât-o la 17%.
Potrivit OpenAI, marcajul nu identifică utilizatorul, contul, organizația, conversația sau promptul și nu arată cât din text provine de la om și cât de la AI. Compania avertizează că marcajul nu garantează corectitudinea informațiilor, iar lipsa lui nu dovedește că un text a fost scris de un om. OpenAI spune că va ajusta sistemul pe măsură ce evoluează tehnologia, standardele și cerințele de reglementare.
Anthropic introdusese deja un sistem asemănător de marcare a textelor generate de AI.
Toate articolele (3)
- 6 oct., 08:50 Digi24 ChatGPT va marca invizibil textele pe care le generează, pentru a putea fi identificate, potrivit regulilor UE (se deschide în filă nouă) „ChatGPT va marca invizibil textele pe care le generează, pentru a putea fi identificate, potrivit regulilor UE”
- 6 oct., 09:51 PROFIT.ro | Economie OpenAI va marca textele produse de inteligența artificială în Uniunea Europeană (se deschide în filă nouă)
- 6 oct., 11:35 Mediafax Schimbare importantă pentru ChatGPT în Europa: OpenAI introduce watermark în textele generate de AI (se deschide în filă nouă)