Lilith Lilith.
Ilustracja redakcyjna: Pozew: Ofiara twierdzi, że Grok był trenowany na prawdziwych materiałach z wykorzystywaniem dzieci
Ilustracja Lilith · remiks redakcyjny

xAI stoi w obliczu pierwszego pozwu za trenowanie na CSAM

Według Ars Technica firma xAI stoi w obliczu pozwu zbiorowego ze strony kobiety (pod pseudonimem Jane Doe), której zdjęcia z dzieciństwa przedstawiające wykorzystywanie z początku lat dwutysięcznych zostały w sposób możliwy do zweryfikowania wykorzystane do trenowania modelu Grok. To pierwszy raz, kiedy xAI zostało bezpośrednio oskarżone o trenowanie na CSAM (materiałach przedstawiających seksualne wykorzystywanie dzieci).

Powódka odkryła, że Grok nie tylko trenował na jej oryginalnych zdjęciach, których hasze od dawna są utrzymywane przez organizacje takie jak NCMEC i kanadyjskie centrum CCCP, ale nawet zaczął generować nowe wersje AI tych materiałów.

Pętla sprzężenia zwrotnego generowania i uczenia się

Problemem nie jest tylko początkowy zestaw danych, ale także samo działanie modelu Grok. Wyniki generowane przez Groka na podstawie monitów są zapisywane do dalszego trenowania. Tworzy to pętlę, w której Grok generuje materiał CSAM, a następnie uczy się z niego ponownie, wzmacniając w ten sposób swoją zdolność do jego dalszego generowania.

W przeciwieństwie do przemocy, którą xAI według pozwu odfiltrowuje ze swoich wyników, CSAM, materiały NSFW czy intymne obrazy bez zgody (NCII) nie są wyraźnie zakazane w regulaminie.

Niemożność zapomnienia z danych treningowych

Usunięcie określonych przykładów treningowych z już wytrenowanego modelu LLM jest technicznie niezwykle skomplikowane. Pozew słusznie wskazuje, że każdy materiał CSAM wchłonięty w fazie treningowej nadal kształtuje wyniki modelu nawet po usunięciu oryginalnego obrazu z publicznego internetu. Ponadto firma xAI nigdy publicznie nie twierdziła, że jest w stanie usunąć dane z modelu.

Co zdecyduje o przyszłym kierunku Groka

Powódka domaga się nie tylko odszkodowania finansowego za naruszenie prawa federalnego i prawa Maszy. Prosi sąd o nakazanie xAI zniszczenia wszystkich przechowywanych materiałów CSAM wygenerowanych przez Groka i zablokowania możliwości modelu do generowania czegokolwiek zseksualizowanego. Jeśli sąd przychyli się do wniosku, będzie to oznaczać koniec stanowiska Muska w sprawie absolutnej wolności słowa dla jego AI, wymuszając wdrożenie takich samych filtrów bezpieczeństwa, jakie mają inni główni gracze na rynku.

Werdykt Lilith

Twierdzenie, że model nie ma zabezpieczeń w imię wolności słowa, sprawdza się w polityce, ale zderza się ze ścianą, gdy pętla maszynowa zaczyna replikować skatalogowane materiały śledcze.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗