Lilith.
⌕

Lilith · výběr zpráv

Novinky

Co se v AI skutečně děje. Vybrané zprávy, souvislosti a názor bez reklamního hluku.

Atom feed ↗
#mainstream· × <built-in method clear of dict object at 0xf5f988150500>
publikováno
publikováno

Neviditelný vodoznak láme obranu. Text watermarking nečekaně otevírá modely injection útokům

Nový výzkum ukazuje, že techniky vkládání vodoznaků do AI textu mají vedlejší účinek. Způsobují, že modely začnou být náchylnější k plnění škodlivých instrukcí, které by normálně odmítly. Pro vývojáře to znamená volbu mezi dohledatelností obsahu a celkovou bezpečností modelu.

publikováno
publikováno
publikováno
publikováno
publikováno

Google, OpenAI a Anthropic tajně ladili pravidla hry, zatímco nová administrativa žádá akceleraci

OpenAI potvrdilo týdny jednání o bezpečnosti s Anthropicem a Google DeepMind, zatímco nová americká administrativa Trumpova týmu bezpečnostní obavy odmítá a tlačí na rychlé udržení tempa s Čínou. Trh zjišťuje, jestli jde o bezpečnostní pakt, nebo způsob, jak odříznout menší konkurenci.