Skrivena struktura

ChatGPT dobija nevidljivi vodeni žig: Odaje da je tekst pisao AI, ali ima jednu slabost

Autor Dragana Božić Izvor Smartlife

Umjesto vidljivih pečata ili dodavanja skrivene strukture karaktera, textGrain utiče na izbor riječi kako bi stvorio mašinski čitljiv statistički obrazac.

Izvor: Ilija Baošić

Tekst koji napiše ChatGPT uskoro bi mogao da nosi nevidljivu oznaku koja otkriva da ga je napravila vještačka inteligencija. OpenAI počinje da uvodi tehnologiju pod nazivom textGrain, ali prvi testovi pokazuju jedno veliko ograničenje.

Za razliku od vodenog žiga na fotografiji, textGrain ne dodaje nikakav vidljiv znak u tekst. Umjesto toga, sistem utiče na izbor riječi koje AI koristi i tako stvara statistički obrazac koji specijalizovani detektor kasnije može da prepozna.

OpenAI uvodi textGrain tehnologiju u skladu sa zahtjevima evropskog Akta o vještačkoj inteligenciji, ali će ona najprije biti ponuđena korisnicima OpenAI API-ja širom svijeta kao opcija koju mogu sami da uključe.

U Evropskoj uniji kompanija planira da ode korak dalje. OpenAI će u narednim nedjeljama početi automatski da primjenjuje ovu tehnologiju na tekstualne odgovore koje generišu ChatGPT i Codex.

Koliko dobro takav nevidljivi vodeni žig funkcioniše zavisi i od dužine teksta. Prema internim testovima OpenAI-a, detektor je oznaku prepoznao u oko 80 odsto tekstova dužine 200 tokena. Kod tekstova od 400 tokena uspješnost je u pojedinim oblastima dostizala približno 95 odsto.

Rezultati su slabiji kod matematike i drugih sadržaja u kojima model nema veliku slobodu pri izboru riječi. Pošto textGrain upravo kroz taj izbor ostavlja prepoznatljiv statistički obrazac, manje mogućih formulacija znači i manje prostora za pouzdano označavanje.

Još veći problem nastaje kada čovjek naknadno izmijeni AI tekst. U jednom testu, zamjena samo 10 odsto riječi sinonimima smanjila je uspješnost detekcije sa 92 na 66 odsto. Kada je zamijenjena četvrtina riječi, uspješnost je pala na svega 17 odsto.

To znači da textGrain ne može pouzdano da odgovori na pitanje ko je napisao neki tekst. OpenAI naglašava da sistem ne utvrđuje autorstvo ili vlasništvo, niti može da pokaže koliko je čovek učestvovao u pisanju i naknadnom uređivanju sadržaja.

Vodeni žig takođe nije povezan sa konkretnim korisnikom ili OpenAI nalogom. Njegova svrha je da detektoru pruži signal da je tekst vjerovatno nastao pomoću AI sistema, a ne da otkrije identitet osobe koja ga je generisala.

OpenAI planira da objavi i izvorni kod textGrain tehnologije. Time će istraživači i razvojna zajednica dobiti mogućnost da nezavisno testiraju koliko je sistem pouzdan, ali i koliko lako njegov nevidljivi trag može da se izgubi kada AI tekst prođe kroz ljudske ruke.

(Smartlife/Mondo)

Tagovi