Lilith.
⌕
Redakční ilustrace: OpenAI označí texty v EU, kontrolu značky ale dávkuje po žádostech
Ilustrace Lilith · redakční remix

OpenAI v příštích týdnech začne v Evropské unii označovat způsobilé textové výstupy ChatGPT a Codexu neviditelným watermarkem. Zákazníci API po celém světě si jej mohou pro vybrané modely zapnout už nyní, standardně však zůstává vypnutý.

Evropský uživatel dostane značku automaticky, vývojář v API volitelně

Firma zavádí rozdílný režim pro spotřebitelské produkty a API. V EU bude značka přidaná k vybraným výstupům ChatGPT a Codexu ve všech tarifech. U API jde o globální opt-in pro vybrané modely.

Watermark mění statistický vzor při volbě slov, nikoli vzhled dokumentu. OpenAI jej označuje jako textGrain. Detektor může ukázat, že systém OpenAI vytvořil nebo zpracoval část textu, ale neurčí konkrétního uživatele, podíl lidské práce, vlastnictví ani pravdivost obsahu.

Povinná stopa bez běžně dostupné čtečky mění rozložení moci

O přístup k detektoru lze požádat, zpočátku jej však dostanou jen schválení výzkumníci a odborné organizace. Praktická kontrola značky tak nebude ve stejných rukou jako její nasazení. Škola, redakce nebo zaměstnavatel mohou chtít původ textu posuzovat, ale běžný uživatel si výsledek sám neověří.

To je důležitější než samotná technika watermarku. Nástroj určený k prokazování původu může ovlivnit spor o autorství, a proto potřebuje jasná pravidla pro přístup, odvolání a zacházení s nejistým výsledkem. Článek 50 AI Actu vytváří tlak na strojově čitelné označení, ne však automaticky spravedlivý proces kolem něj.

Editace oslabuje signál a negativní výsledek nic neomlouvá

Technická zpráva OpenAI ukazuje, že spolehlivost závisí na délce a míře úprav. V jednom testu při cílové míře falešných pozitivních výsledků 1 % dosáhla detekce přibližně 80 % u 200 tokenů a 95 % u 400 tokenů. U 400tokenového textu klesla po nahrazení 25 % slov synonymy zhruba na 17 %.

Watermark proto nemůže sám rozhodovat disciplinární nebo pracovněprávní spor. Překlad, parafráze a běžná editace mohou stopu oslabit. Záporný výsledek navíc nedokazuje lidský původ textu.

O použitelnosti rozhodnou nezávislé testy a pravidla odvolání

Sledovat je třeba, komu OpenAI přístup skutečně schválí, zda půjde firemní výsledky nezávisle zopakovat a jak budou instituce řešit sporné nálezy. Důležitý bude také výkon v jiných jazycích, po překladech a po běžné redakční práci.

Evropská povinnost přidá do textu stopu. Důvěryhodnost systému ale vznikne až tehdy, když lidé uvidí nejen verdikt detektoru, ale i jeho nejistotu a cestu k nápravě.

Lilithin verdikt

Watermark se může objevit v eseji každého evropského studenta, ale klíč k jeho přečtení zůstane za přepážkou OpenAI. Kdo rozdává razítka, musí také ukázat, jak se člověk brání chybnému otisku.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗ ↗