Tehnologie

ChatGPT primește filigran invizibil în UE, unealta pe care OpenAI a ținut-o la sertar

Adrian Kessler
Adaugă-ne în Google

Multă vreme, OpenAI a explicat public de ce nu va aplica un filigran textelor generate de ChatGPT. Acum, îl aplică totuși. Nu tehnologia s-a răzgândit. Ci o lege, cu termen-limită și amendă.

Compania spune că textele generate de ChatGPT și Codex pentru utilizatorii din Uniunea Europeană vor avea o semnătură statistică invizibilă, introdusă treptat în următoarele săptămâni pentru toate planurile. În restul lumii, același marcaj este disponibil doar ca opțiune în API-ul pentru dezvoltatori, iar aceasta este dezactivată implicit. Linia trasată de OpenAI urmează granița jurisdicției care o poate sancționa.

Cum funcționează filigranul ChatGPT

Metoda, numită textGrain, nu lasă nimic vizibil în textul generat. Când mai multe cuvinte ar putea urma la fel de bine într-o propoziție, o cheie secretă înclină alegerea în favoarea unuia dintre ele. O singură ajustare nu înseamnă nimic. Sute de astfel de ajustări, răspândite într-un pasaj, formează un tipar pe care un detector care deține cheia îl poate verifica; iar pentru că semnalul este încorporat în cuvinte, acesta rezistă copierii și lipirii. OpenAI a redactat raportul tehnic împreună cu cercetători de la University of Pennsylvania și Yale. Raportul nu indică niciun compromis semnificativ în privința calității: pe Artificial Analysis Intelligence Index, textele cu filigran au obținut 49,76, față de 49,57 pentru cele fără marcaj.

Instrumentul pe care OpenAI îl avea deja

Nimic din toate acestea nu este o noutate în interiorul OpenAI. În vara lui 2024, Wall Street Journal a relatat că firma avea un filigran textual funcțional, evaluat în documente interne ca fiind eficient în proporție de 99,9%, dar nu îl lansase. OpenAI a răspuns că adoptă „o abordare deliberată”. Motivele invocate au fost de ordin tehnic și social: metoda era „ușor de ocolit de actorii rău intenționați” prin traducere sau reformulare cu ajutorul unui alt model și putea stigmatiza folosirea inteligenței artificiale ca instrument de scriere de către persoanele pentru care engleza nu este limba maternă. TechCrunch, relatând despre anunțul din această săptămână, amintește un al treilea motiv invocat atunci: teama că utilizatorii ar trece la concurenți care nu aplicau filigrane.

Privită în lumina acestui istoric, noua lansare arată de care dintre aceste temeri s-a ocupat, de fapt, OpenAI. Problema ocolirii persistă, chiar potrivit cifrelor companiei. Riscul comercial a fost limitat la o singură piață.

Cifrele OpenAI, nu ale criticilor săi

În condiții bune, la o rată de rezultate fals pozitive de 1%, detectorul identifică aproximativ 80% dintre pasajele de 200 de tokeni marcate cu filigran și circa 95% dintre cele de 400 de tokeni. Dacă 10% dintre cuvinte sunt înlocuite cu sinonime, rata de detectare scade de la 92% la 66%. Dacă este înlocuit un sfert dintre cuvinte, scade la 17%. Răspunsurile scurte, textele matematice și cele traduse sunt foarte greu de detectat. OpenAI avertizează chiar că performanța ridicată în condiții ideale „nu garantează o detectare fiabilă în utilizarea de zi cu zi” și că absența filigranului nu dovedește că textul a fost scris de un om. Compania mai spune că marcajul nu identifică utilizatorul.

Asta face din textGrain un semnal util împotriva copierii și lipirii făcute fără prea multă grijă, dar unul slab în fața oricui este dispus să-și petreacă un minut editând textul. Într-un bloc în care se citesc și se scriu multe limbi, problema traducerilor nu este un simplu detaliu.

De ce UE și de ce acum

Motivul juridic este articolul 50 din AI Act, ale cărui reguli privind transparența au intrat în vigoare pe 2 august. Acesta le cere furnizorilor de sisteme generative să marcheze într-un format care poate fi citit de mașini textele, fișierele audio, imaginile și videoclipurile sintetice și să pună la dispoziție un mecanism de detectare. Sistemele deja existente pe piață înainte de acea dată, inclusiv ChatGPT, au termen până pe 2 decembrie să se conformeze. Încălcările pot atrage amenzi de până la 15 milioane de euro sau 3% din cifra de afaceri anuală globală, luându-se în calcul suma mai mare, potrivit unei analize realizate de firma de avocatură Cooley.

Două detalii arată cât de îndeaproape urmează lansarea obligația legală, nu un principiu. Primul este detectorul. Legea cere un mecanism de detectare; OpenAI a construit unul și l-a oferit doar cercetătorilor aprobați și organizațiilor de specialitate, care trebuie să depună o cerere. Compania spune că va extinde accesul „când vom considera că rezultatele pot fi interpretate în mod responsabil”, relatează The Decoder, dar nu a indicat niciun calendar. Un profesor sau un redactor din Lisabona ori Varșovia care are în față un text suspect nu îl poate verifica astăzi.

Al doilea detaliu este harta. Anthropic, care a început să aplice filigrane textelor generate de Claude în august, folosește marcajul la nivel global, indiferent de modul în care oamenii accesează modelele sale, și a atras critici din partea unor utilizatori. OpenAI a ales contrariul: activare implicită acolo unde autoritatea de reglementare poate da amenzi, opțiune pentru dezvoltatori în restul lumii și nicio setare implicită globală la lansare. Dacă vechea teamă că utilizatorii vor migra către concurenți fără filigran ar fi dispărut, ar exista puține motive pentru a trasa harta în felul acesta.

Ce urmează

OpenAI spune că va publica textGrain ca software open-source și că metoda egalează sau depășește soluții precum SynthID de la Google. Ambele afirmații vor putea fi verificate odată ce codul devine public. Pentru Bruxelles, întrebarea este mai restrânsă: dacă un marcaj care se estompează după o editare superficială, verificat cu un detector pe care aproape nimeni nu îl poate folosi, respectă o regulă concepută astfel încât alte sisteme să poată recunoaște textele generate de inteligența artificială.

După 2 decembrie, singurii utilizatori ChatGPT ale căror texte vor purta implicit semnătura OpenAI vor fi cei ale căror autorități de reglementare îi pot trimite nota de plată.

Etichete: , , , ,

Adaugă-ne în Google

Discuție

Există 0 comentarii.