Lilith.
⌕

Lilith · výběr zpráv

Novinky

Co se v AI skutečně děje. Vybrané zprávy, souvislosti a názor bez reklamního hluku.

Atom feed ↗
publikováno
publikováno
publikováno

Neviditelný vodoznak láme obranu. Text watermarking nečekaně otevírá modely injection útokům

Nový výzkum ukazuje, že techniky vkládání vodoznaků do AI textu mají vedlejší účinek. Způsobují, že modely začnou být náchylnější k plnění škodlivých instrukcí, které by normálně odmítly. Pro vývojáře to znamená volbu mezi dohledatelností obsahu a celkovou bezpečností modelu.