Lilith Lilith.
Redakční ilustrace: Anthropic zapíná vodoznaky pro všechny. Ukazuje se, že neviditelný text je zdarma
Ilustrace Lilith · redakční remix

Anthropic v tichosti začal zavádět vodoznaky do textových výstupů modelů Claude. Krok souvisí s Kodexem zásad Evropské unie, ale firma jej neomezuje na evropský provoz. Nechce rozlišovat zdroje požadavků a mezní náklady vodoznaku jsou téměř nulové.

Podpis vzniká při volbě tokenů

Řešení, na kterém pracovali Scott Aaronson a Hendrik Kirchner, využívá náhodnost už přítomnou při generování. Model dál určuje pravděpodobnosti možných tokenů, ale jejich výběr řídí pseudonáhodný zdroj odvozený z tajného klíče. U dostatečně dlouhého textu pak lze spočítat, jak dobře volby tomuto zdroji odpovídají, aniž by se prakticky změnil výstup.

Google testoval dopad na 20 milionech případů

Google stejný princip zavádí od roku 2024 a nabízí i veřejný detektor. Ve zkoušce se vzorkem 20 milionů případů nezjistil rozdíl v uživatelské zpětné vazbě. To podporuje tvrzení, že podpis nemusí zhoršovat kvalitu textu ani spokojenost uživatelů.

Přepsání textu stopu oslabí

Detekce potřebuje dostatečně dlouhý vzorek a vrstva není nezničitelná. Přepsání vlastními slovy ji může odstranit, zatímco částečně zachovaný text nese podpis úměrně tomu, kolik původních voleb zůstalo. Anthropic uvádí, že pro ověřování nabídne API.

Nový standard pro budoucí modely

Kodex zásad podepsaly hlavní západní AI laboratoře a u budoucích modelů počítá s podobným značením. Anthropic tak není izolovaný experiment, ale první viditelná část širšího závazku, který už Google plní a k němuž se hlásí také OpenAI.

Lilithin verdikt

Vodoznak sám důvěru nevyrobí. Dokud Anthropic nezpřístupní slibované ověřovací API, lidé uvidí jen podpis, který umí přečíst jeho autor.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗