Lilith Lilith.
Ilustracja redakcyjna: Badacze użyli Claude'a do zhakowania wewnętrznych systemów OpenAI
Ilustracja Lilith · remiks redakcyjny

AI atakuje konkurencyjne laboratorium AI

Trzem badaczom bezpieczeństwa udało się skompromitować wewnętrzne systemy OpenAI, wykorzystując luki w firmowym forum społecznościowym. Zdołali przejąć konta ChatGPT pracowników i uzyskać dostęp do wrażliwego kodu źródłowego. Wyjątkowe w tym ataku nie są jednak same exploity, ale metoda: badacze przeprowadzili całą operację z pomocą konkurencyjnego modelu Claude od firmy Anthropic, który pomógł im połączyć luki i ominąć zabezpieczenia w niecałe 72 godziny.

Asystent bezpieczeństwa ofensywnego zmienia zasady gry

Dla zespołów bezpieczeństwa pokazuje to gwałtowną zmianę w zdolnościach ofensywnych oferowanych przez modele AI. Claude nie służył tylko jako wyszukiwarka składni; badacze użyli go jako partnera analitycznego do zrozumienia struktury docelowej aplikacji i zaprojektowania konkretnych wektorów ataku, z którymi starsze modele nie mogły sobie poradzić. Drastycznie skraca to czas i zmniejsza zapotrzebowanie na głęboką wiedzę techniczną wymaganą do znalezienia i wykorzystania błędów.

Przyspieszenie ataków wyprzedza obronę

Rzeczywistość ofensywnego wykorzystania AI jest taka, że obecnie modele pomagają atakującym znacznie bardziej niż obrońcom. Nawet najlepsze laboratoria, takie jak OpenAI, ewidentnie nie nadążają z ochroną własnej infrastruktury przed atakami wspieranymi przez modele AI konkurencji. Obrona wymaga systemowej bezbłędności, podczas gdy do włamania wystarczy znalezienie za pomocą modelu kilku zapomnianych błędów konfiguracyjnych.

Presja na zabezpieczenie wewnętrznego rozwoju

Incydent pokaże, czy narzędzia programistyczne i fora laboratoriów zostaną w końcu oddzielone od produkcyjnych danych badawczych i kont. Dowodem nie będą kolejne białe księgi o bezpieczeństwie modeli, ale to, czy laboratoria przestaną używać logowania jednokrotnego (SSO) do witryn społecznościowych i wewnętrznych repozytoriów GitHub jednocześnie.

Werdykt Lilith

Wiodąca firma AI, której kod wycieka przez lukę na forum przy pomocy konkurencyjnego modelu. Programiści nie potrzebują więcej superinteligencji, muszą wreszcie oddzielić witryny produkcyjne od społecznościowych.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗