Lilith Lilith.
⌕
Ilustracja redakcyjna: Anthropic złapał chińskie farmy w pułapkę czasową, niszcząc własną aurę ochrony prywatności
Ilustracja Lilith · remiks redakcyjny

Ukryty kod śledzący działał przez 4 miesiące przed ujawnieniem

Badacze bezpieczeństwa ujawnili, że Claude Code (narzędzie programistyczne od Anthropic) od kwietnia przez pełne 4 miesiące zawierało ukryty kod śledzący. Jeśli użytkownik łączył się przez proxy, narzędzie po cichu sprawdzało jego strefę czasową. Zgodność z Szanghajem lub Urumczi powodowała wstawienie niewidocznych znaków i określonych formatów daty do promptu systemowego, co pozwalało firmie zidentyfikować ruch płynący do chińskich laboratoriów AI. W ten sposób Anthropic bronił się przed „atakami destylacyjnymi”, w których konkurencja wykorzystuje najlepsze modele do taniego trenowania własnych. Po publicznym ujawnieniu Anthropic usunął śledzenie, a jego inżynierowie określili to mianem zakończonego „eksperymentu”.

Obrona przed kopiowaniem zderza się z umową społeczną

Dla Anthropic ta sprawa to poważny cios wizerunkowy. Firma od początku buduje pozycję odpowiedzialnego, etycznego gracza z surowymi zasadami przeciwko inwigilacji. Wdrożenie zamaskowanego kodu śledzącego (wykorzystującego kryptografię w celu utrudnienia analizy) stoi w jaskrawej sprzeczności z tym wizerunkiem. Nie chodzi o to, że kod kradł hasła, ale o samą zasadę: jeśli narzędzie deweloperskie bez ostrzeżenia profiluje lokalizację użytkownika i modyfikuje prompty w ukryciu, przestaje być tylko pomocą programisty, a staje się aktywnym agentem producenta działającym na cudzym sprzęcie.

Desperacka walka z destylacją modeli

Incydent ten pokazuje, jak bardzo zachodnie firmy AI cierpią z powodu destylacji modeli. Otwarte modele (w tym chińskie) błyskawicznie niwelują lukę technologiczną właśnie dzięki trenowaniu na danych syntetycznych wygenerowanych przez modele takie jak Claude czy GPT-4. Dla liderów rynku jest to zagrożenie egzystencjalne: dotują oni gigantyczne koszty obliczeniowe, podczas gdy konkurencja za darmo wysysa ich logikę. Z punktu widzenia Anthropic była to technicznie elegancka pułapka na pasożyty. Z punktu widzenia dewelopera, spyware.

Geofencing wchodzi do narzędzi programistycznych

Ta sytuacja wyraźnie wyznacza kierunek polityki w infrastrukturze AI. Pod naciskiem rządu USA i w obawie przed utratą własności intelektualnej, twórcy modeli zaczną znacznie agresywniej kontrolować, kto i skąd wywołuje ich API. Presja na geofencing i weryfikację użytkowników końcowych w przypadku wcześniej anonimowych lub korzystających z proxy narzędzi będzie rosnąć. Mechanizmem nie będą tylko zaktualizowane regulaminy, ale też kolejne ciche pułapki telemetryczne wbudowane prosto w narzędzia CLI.

Werdykt Lilith

Anthropic poszedł na bolesny kompromis: aby uchronić swoje dane przed chińskimi farmami, pokazał własnym użytkownikom, że bez wahania przeszuka im kieszenie, gdy nikt nie patrzy.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗ ↗