Skrivena struktura

ChatGPT dobija nevidljivi vodeni žig: Odaje da je tekst pisao AI, ali ima jednu slabost

Umesto vidljivih pečata ili dodavanja skrivene strukture karaktera, textGrain utiče na izbor reči kako bi stvorio mašinski čitljiv statistički obrazac. Dodajte Smartlife u vaš Google izbor
Foto: Ilija Baošić
  • OpenAI uvodi textGrain, nevidljivi vodeni žig za AI tekst.
  • Interni testovi pokazuju da detekcija zavisi od dužine teksta, ali i da se lako narušava kada čovek naknadno menja AI sadržaj.

Tekst koji napiše ChatGPT uskoro bi mogao da nosi nevidljivu oznaku koja otkriva da ga je napravila veštačka inteligencija. OpenAI počinje da uvodi tehnologiju pod nazivom textGrain, ali prvi testovi pokazuju jedno veliko ograničenje.

Za razliku od vodenog žiga na fotografiji, textGrain ne dodaje nikakav vidljiv znak u tekst. Umesto toga, sistem utiče na izbor reči koje AI koristi i tako stvara statistički obrazac koji specijalizovani detektor kasnije može da prepozna.

OpenAI uvodi textGrain tehnologiju u skladu sa zahtevima evropskog Akta o veštačkoj inteligenciji, ali će ona najpre biti ponuđena korisnicima OpenAI API-ja širom sveta kao opcija koju mogu sami da uključe.

U Evropskoj uniji kompanija planira da ode korak dalje. OpenAI će u narednim nedeljama početi automatski da primenjuje ovu tehnologiju na tekstualne odgovore koje generišu ChatGPT i Codex.

Koliko dobro takav nevidljivi vodeni žig funkcioniše zavisi i od dužine teksta. Prema internim testovima OpenAI-a, detektor je oznaku prepoznao u oko 80 odsto tekstova dužine 200 tokena. Kod tekstova od 400 tokena uspešnost je u pojedinim oblastima dostizala približno 95 odsto.

Rezultati su slabiji kod matematike i drugih sadržaja u kojima model nema veliku slobodu pri izboru reči. Pošto textGrain upravo kroz taj izbor ostavlja prepoznatljiv statistički obrazac, manje mogućih formulacija znači i manje prostora za pouzdano označavanje.

Još veći problem nastaje kada čovek naknadno izmeni AI tekst. U jednom testu, zamena samo 10 odsto reči sinonimima smanjila je uspešnost detekcije sa 92 na 66 odsto. Kada je zamenjena četvrtina reči, uspešnost je pala na svega 17 odsto.

To znači da textGrain ne može pouzdano da odgovori na pitanje ko je napisao neki tekst. OpenAI naglašava da sistem ne utvrđuje autorstvo ili vlasništvo, niti može da pokaže koliko je čovek učestvovao u pisanju i naknadnom uređivanju sadržaja.

Vodeni žig takođe nije povezan sa konkretnim korisnikom ili OpenAI nalogom. Njegova svrha je da detektoru pruži signal da je tekst verovatno nastao pomoću AI sistema, a ne da otkrije identitet osobe koja ga je generisala.

OpenAI planira da objavi i izvorni kod textGrain tehnologije. Time će istraživači i razvojna zajednica dobiti mogućnost da nezavisno testiraju koliko je sistem pouzdan, ali i koliko lako njegov nevidljivi trag može da se izgubi kada AI tekst prođe kroz ljudske ruke.