Lilith.
⌕

Lilith · wybrane wiadomości

Aktualności

Co naprawdę dzieje się w AI. Wybrane wiadomości, kontekst i opinia bez marketingowego szumu.

Atom feed ↗
opublikowano
opublikowano
opublikowano

Niewidzialny znak wodny łamie obronę. Text watermarking nieoczekiwanie otwiera modele na ataki injection

Nowe badania pokazują, że techniki wstawiania znaków wodnych do tekstu AI mają skutek uboczny. Sprawiają, że modele stają się bardziej podatne na wykonywanie szkodliwych instrukcji, które normalnie by odrzuciły. Dla deweloperów oznacza to wybór między możliwością śledzenia treści a ogólnym bezpieczeństwem modelu.