← Knihovna · Pojem
Vodoznaky v AI textu — možnosti a limity
Neviditelné statistické signály ve výstupech AI mohou doložit původ textu, ale neprokážou autorství ani spolehlivě nerozliší všechen lidský a strojový obsah.
Co je vodoznak v textu AI?
Textový vodoznak není skrytý znak ani tajná věta. U jedné známé konstrukce model při generování mírně zvýhodňuje tokeny z množiny odvozené z tajného klíče a předchozího textu. Detektor pak ověřuje, zda se takové tokeny objevují častěji, než by odpovídalo náhodě. Jde o statistický signál vygenerovaný zúčastněným modelem, ne o univerzální test pro každý text na internetu. Popis metody
Praktický příklad: redakce si může u nezměněného návrhu vytvořeného vlastním nástrojem ověřit, zda nese očekávaný signál. Kladný výsledek podporuje tvrzení o původu tohoto výstupu. Neříká však sám o sobě, kdo text napsal, zda člověk návrh upravil ani zda jiný text bez signálu nevznikl s pomocí AI.
Kde se signál ztrácí
Výsledek závisí na konkrétním schématu, délce ukázky a míře úprav. Výzkum popisuje návrhy, které dokážou zachytit stopu i po parafrázi, pokud mají k dispozici dostatek textu; parafráze a přimíchání do jiného textu však sílu signálu oslabují. Studie robustnosti
Jiný zátěžový test ukázal, že opakovaná parafráze může u různých detekčních postupů, včetně vodoznaků, výrazně snížit míru zachycení. Popsal také útoky, které mohou lidský text chybně označit jako strojový. Zátěžový test detektorů Vodoznak proto nedává smysl jako jediný podklad pro sankci nebo jako automatické rozhodnutí o původu obsahu.
Co z něj lze vyčíst
Vodoznak je užitečný hlavně jako úzce vymezený důkaz o tom, že konkrétní systém mohl vytvořit konkrétní, dostatečně dlouhý a málo upravený výstup. Jeho použití vyžaduje popsat systém, detektor i význam pozitivního a negativního nálezu. Bez těchto podmínek se z technického signálu snadno stane nepřesná nálepka „AI text“.