ChatGPT va marca invizibil textele pe care le generează, pentru a putea fi identificate. Anunțul a fost făcut de OpenAI. Compania spune că va introduce watermark-uri conform noilor reguli din Uniunea Europeană.
OpenAI va începe să adauge watermark-uri invizibile în textele produse de ChatGPT, pentru ca acestea să poată fi identificate, conform noilor reguli din Uniunea Europeană, a anunțat compania, luni, într-o postare pe site-ul său.
Regulile de transparență ale Legii UE privind Inteligența Artificială, care au intrat în vigoare pe 2 august, impun companiilor de AI să marcheze conținutul generat de chatbot-uri într-un mod în care alte sisteme îl pot identifica.
OpenAI a declarat că watermark-ul va fi lansat în următoarele săptămâni pentru utilizatorii eligibili ChatGPT și Codex pentru toate abonamentele, dar numai în UE. Dezvoltatorii care utilizează API-ul OpenAI oriunde în lume îl pot activa pentru anumite modele începând de luni. Este dezactivat în mod implicit.
Ce este watermark-ul
OpenAI a precizat că nu va face ca watermark-ul să fie o opțiune implicită la nivel global la lansare. Watermark-ul nu este un simbol propriu-zis, ci funcționează prin modelarea subtilă a alegerilor de cuvinte, lăsând un model pe care cititorii nu îl pot vedea, dar pe care un detector îl poate identifica.
Deoarece este încorporat în cuvintele în sine, acesta călătorește odată cu textul atunci când este copiat și lipit. OpenAI a declarat că watermark-ul nu identifică utilizatorul și că nu a observat nicio schimbare semnificativă în performanța modelelor sale atunci când este activat.
Metoda textGrain
OpenAI a publicat, de asemenea, un raport tehnic pentru metoda sa, numită textGrain, odată cu anunțul legat de introducerea watermark-urilor invizibile. Scris în colaborare cu cercetători de la Universitatea din Pennsylvania și Yale, acesta prezintă un exemplu de utilizare a unei chei secrete pentru a sorta predicțiile cuvântului următor pentru a termina propoziția.
Dacă aduni sute de astfel de ajustări subtile, detectorul poate identifica conținutul generat de AI folosind doar textul și cheia.
Poate fi eliminat watermark-ul prin editare?
Testele OpenAI sugerează că da. Într-un test, înlocuirea a 10% dintre cuvinte cu sinonime a scăzut detectarea de la aproximativ 92% la 66%. Compania a mai spus că pasajele scurte, răspunsurile la matematică și textele traduse sunt mai greu de detectat.
"Aceste limitări contribuie la decizia noastră de a oferi acces inițial la detector doar cercetătorilor și organizațiilor de experți aprobați, care ne pot ajuta să evaluăm fiabilitatea și utilizările responsabile", a declarat OpenAI.
Compania a avertizat, de asemenea, că lipsa unui watermark "nu dovedește autoritatea umană". Textul ar putea fi prea scurt sau prea mult editat sau ar putea proveni de la Inteligența Artificială a altei companii.
"Watermark-urile pot indica faptul că un sistem OpenAI a generat sau procesat o parte a unui pasaj, dar nu cât de multă judecată, editare sau creativitate a fost implicată în acesta", a declarat compania.
Anthropic aplică deja watermark-uri
Anunțul OpenAI vine la două luni după ce Anthropic a declarat că va marca textele generate de Inteligența Artificială Claude, o mișcare pe care o aplică la nivel mondial. Această decizie a stârnit reacții negative din partea unor utilizatori Claude, care au susținut că ei au furnizat "instrucțiunile, contextul, deciziile", în timp ce Claude era doar "instrumentul".
OpenAI a mai creat un watermark înainte, dar a amânat lansarea acestuia, parțial din cauza îngrijorărilor că utilizatorii ar trece la rivali care nu aveau astfel de marcaje pe text, relata The Wall Street Journal în 2024.
Anthropic, Google, Meta, Microsoft și OpenAI se numără printre companiile care s-au angajat să respecte codul de practică al UE privind conținutul generat de Inteligența Artificială. Subiectul reglementării Inteligenței Artificiale este adus tot mai des în discuție în ultima vreme, exitând numeroase îngrijorări legate de evoluția AI.

