2026-08-09 · ← Aktualności
Anthropic odwraca logikę weryfikacji: tryb automatyczny w Claude Code staje się domyślny
Praca z agentami programistycznymi przypominała do tej pory jazdę z instruktorem, który nerwowo wciska hamulec przed każdym skrzyżowaniem. Anthropic zmienia to podejście. Od 14 sierpnia tryb automatyczny (dotychczas opcjonalna funkcja eksperymentalna) stanie się domyślnym ustawieniem dla kont Pro, Max i Team. Claude Code nie będzie już wymagał zgody człowieka na każdym etapie pracy, a zatrzyma się tylko wtedy, gdy uzna operację za nieodwracalną lub potencjalnie niszczycielską.
Zmęczenie powiadomieniami niszczy bezpieczeństwo bardziej niż sam agent
Ten krok to nie tylko przyspieszenie pracy, ale odpowiedź na problem ludzkiej uwagi. Anthropic podpiera się danymi z testów: użytkownicy szybko przyzwyczajają się do okienek z prośbą o zgodę, mechanicznie akceptując 97% z nich. Ręczna weryfikacja staje się niebezpiecznym nawykiem. W badaniu na próbie ponad tysiąca płacących testerów tryb automatyczny wychwycił 89% szkodliwych akcji, podczas gdy nadzór ludzki zaledwie 13,6%. Ludzie po prostu przestali czytać to, co zatwierdzają.
Zabezpieczenia przenoszą się do konfiguracji i filtrów prompt injection
Kiedy usuwa się człowieka z pętli, trzeba zastosować mocniejsze hamulce gdzie indziej. Wraz z trybem automatycznym Anthropic wprowadza twarde reguły blokowania konfiguracji (hard deny rules) oraz nową warstwę ochrony przed atakami prompt injection. Celem jest zapobieganie kradzieży danych, do której mogłoby dojść, gdyby autonomiczny agent napotkał spreparowane wejście i posłusznie wysłał zawartość repozytorium na zewnątrz.
Koniec niekończącego się mikrozarządzania
Dotychczasowe podejście do autonomii agentów opierało się na iluzji, że człowiek w pięćsetnej iteracji nadal uważa. Przełączenie na domyślny tryb automatyczny oznacza, że zespoły ds. bezpieczeństwa nie mogą już polegać na w pół uśpionym programiście, że odrzuci usunięcie produkcyjnej bazy danych.
Egzaminem dojrzałości będzie umiejętność wycofania się z błędów
Prawdziwym testem dla tej zmiany nie będzie to, jak szybko Claude generuje kod na prostej ścieżce (happy path), ale co się stanie, gdy popełni błąd podczas autonomicznej pracy. Prędkość jest zaletą, ale jeśli automatyzacja wprowadzi serię nieudanych zmian, a programista nie będzie miał narzędzi do rozplątania logów audytu i przywrócenia repozytorium do poprzedniego stanu, użytkownicy po prostu ponownie wyłączą tę funkcję.
Werdykt Lilith
Zmuszanie człowieka do klikania OK przy każdej linijce kodu to nie bezpieczeństwo, to tylko alibi. Anthropic właśnie zabrał to alibi.
Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.
Oryginalne źródło ↗ ↗