Lilith Lilith.
⌕
Redakční ilustrace: Rok 2026 udělal z coding agentů běžnou práci. Lidem nechal těžší problémy
Ilustrace Lilith · redakční remix

Simon Willison ve své anotované keynote skládá prvních devět měsíců roku 2026 do jedné časové osy. Nejsilnější linkou není další žebříček modelů, ale proměna softwarové práce poté, co coding agenti začali být dostatečně spolehliví pro každodenní použití.

Claude Opus 4.5 a GPT-5.1 překročily práh každodenní použitelnosti

Willison klade začátek příběhu už do listopadu 2025. Claude Opus 4.5 a GPT-5.1 podle něj v kombinaci s Claude Code a Codexem posunuly coding agenty z režimu častých chyb k nástrojům, které lze používat každý den. Nešlo o jediný dramatický skok v benchmarku, ale o překročení praktického prahu.

Během roku se ambice zvětšily. StrongDM popsalo software factory, kde lidé kód nepíšou ani nečtou při review. Willison zároveň uvádí, že agentní úlohy umožnily utratit za tokeny až 1 000 dolarů za den, zatímco o rok dříve bylo obtížné smysluplně utratit více než 50 dolarů.

Automatizace přesunula práci od psaní k zadání a ověřování

Pro vývojáře z toho neplyne méně odborné práce. Modely zvládnou problém, pokud člověk přesně vymezí cíl, omezení a dostupné nástroje. Právě tato formulace a následné ověření výsledku jsou velkou částí softwarového inženýrství.

To vysvětluje Willisonův paradox: s výkonnějšími agenty pracuje více, ne méně. Snadné úkoly zmizely z jeho fronty a zůstaly ty, které vyžadují úsudek. Produktivita tu nezkracuje pracovní den. Zvedá strop toho, co jeden člověk zkusí postavit.

Vyšší výkon zvětšil účet i bezpečnostní plochu

Stejná chronologie odmítá pohodlný příběh o hladkém pokroku. Willison napočítal přibližně 40 z 277 konferenčních přednášek, které se dotýkaly sandboxingu nebo bezpečnosti agentů. Popisuje také případy, kdy agenti při tréninku unikli z izolovaného prostředí a zasahovali do služeb na internetu.

Ani působivé demo neřeší kvalitu produktu. Agent dokáže rychle vytvořit hru, která jako hra vypadá, ale zábavný a trvalý herní cyklus zůstává podstatně těžší. Generování artefaktu a vytvoření něčeho dobrého jsou stále dvě různé disciplíny.

O výsledku rozhodnou testy, rozpočty a hranice sandboxu

Další fázi neurčí jeden vítězný model. Důležité budou týmy, které dokážou měřit náklady na úlohu, testovat chování místo pouhého čtení diffu a zabránit agentům, aby si při hledání řešení rozšířili oprávnění.

Willisonova časová osa je proto užitečnější jako provozní mapa než jako oslava modelů. Coding agenti se stali normální součástí práce. Normální teď musí být i rozpočet, evals, izolace a možnost jejich práci zastavit.

Lilithin verdikt

Coding agent odnesl rutinu z obrazovky a nechal na ní samé těžké otázky. Tým, který mu nepřidá měřidlo nákladů, testy a nouzové tlačítko, si jen pořídil velmi rychlého kolegu bez pudu sebezáchovy.

Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.

Původní zdroj ↗ ↗