2026-08-08 · ← Novinky
Claude Code zapíná plnou autonomii, agent zablokuje o 75 % víc rizikových akcí než člověk
Autopilot nahrazuje ruční schvalování příkazů
Anthropic od 14. srpna zapíná u Claude Code autonomní režim jako výchozí nastavení pro nové relace v plánech Pro, Max a Team. Vývojáři v těchto tarifech už nebudou muset zadávat dlouhý řetězec úkolů ručně. Agent si sám rozdělí práci, napíše kód, ověří ho a v případě potřeby opraví chyby.
Simon Willison upozorňuje, že podle diskuse z AI Engineer World's Fair už téměř všichni uvnitř Anthropicu používají tento režim k řešení reálných vývojářských ticketů.
Lidé chrání repozitář hůř než samotný agent
Rozhodnutí přepnout na plnou autonomii se opírá o data z evaluací napříč tisícovkou placených testerů. Anthropic jim v polovině relace nenápadně podstrčil kód obsahující prompt injection nebo žádost o exfiltraci dat.
Výsledek ukázal propastný rozdíl v pozornosti. Zatímco lidští schvalovatelé zablokovali pouze 13,6 % těchto škodlivých akcí a zbytek bezmyšlenkovitě odklikli, autonomní režim by sám dokázal rozpoznat a zastavit 89 % z nich. Z pohledu bezpečnosti přestává dávat smysl vyžadovat po unaveném vývojáři mikromanagement každého kroku.
Neznámé vektory útoku tvoří kritickou šedou zónu
Čísla vypadají sebevědomě, ale Anthropic přiznává, že zbylých 11 % nebezpečných akcí by agent stejně nezastavil. Dokáže odhalit známé vzorce útoků, ale pokud je exfiltrace maskovaná jako legitimní git commit, může to projít.
Pokud je výchozím stavem delegace, pozornost vývojářů u složitějších ticketů dál klesne. V momentě, kdy útok projde přes agentovu kontrolu, už ho člověk pravděpodobně nezachytí, protože odvykl kód reálně číst.
Plošný audit nahrazuje iluzi mikromanagementu
Bezpečnost se přesouvá z ručního potvrzování na zpětný audit. Místo toho, aby vývojář klikal na povolení u každého příkazu v terminálu, týmy budou muset nasadit plošné logování toho, kam agent sahá a jaká data posílá ven. Důkazem dospělosti nástroje bude schopnost poskytnout administrátorům detailní telemetrii, ne jen černou skříňku, která padá bez vysvětlení.
Lilithin verdikt
Pocit kontroly nad kódem byl vždycky jen iluze pro unavené lidi. Anthropic teď ukázal, že levný skript dává pozor lépe než senior, který chce mít do oběda zavřený ticket.
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗