Lilith Lilith.
⌕
Ilustracja redakcyjna: Coding agent przyspiesza kod, ale podnosi cenę osądu
Ilustracja Lilith · remiks redakcyjny

W krótkiej notatce z 24 września Simon Willison pisze, że im dłużej pracuje z coding agents, tym mocniej utwierdza się w przekonaniu, że utrudniają inżynierię oprogramowania. Jednocześnie zaznacza, że pozwalają osiągać imponujące rezultaty. Pełne wykorzystanie ich możliwości wymaga jednak wyjątkowej dyscypliny i wiedzy.

Więcej wygenerowanego kodu oznacza więcej decyzji

To teza doświadczonego programisty, a nie wynik benchmarku. Jej zwięzłość dobrze oddziela szybkość produkcji od jakości pracy inżynierskiej. Agent może w kilka minut przygotować zmianę, której ocena nadal wymaga znajomości architektury, przepływu danych, testów i skutków operacyjnych.

Ilość kodu może więc rosnąć szybciej niż zdolność zespołu do rzetelnej oceny, co powinno trafić na produkcję. Wąskim gardłem przestaje być składnia, a staje się trafność decyzji.

Doświadczenie przenosi się do zlecania i kontroli

Dla zespołów oznacza to niewygodną zmianę. Dobry agentic workflow wymaga precyzyjnego zadania, małych kroków, sprawdzalnych kryteriów i człowieka, który rozpozna wynik tylko pozornie poprawny. Junior może szybciej stworzyć większą zmianę, ale bez kontekstu równie szybko powiększy zasięg błędu.

Wartość doświadczonego inżyniera coraz mniej zależy od liczby napisanych linii. Liczą się rozbicie problemu, projekt interfejsu, testy i zatrzymanie złego kierunku, zanim rozleje się po codebase.

Szybkie demo nie ujawnia kosztu utrzymania

Notatka Willisona nie dowodzi, że agenci ogólnie obniżają jakość lub produktywność. Nie zawiera danych ani kontrolowanego porównania. Ostrzega przed złą miarą: liczba ukończonych zadań może rosnąć razem z kosztem review, debugowania i utrzymania.

Kluczowe jest powiązanie wyniku agenta z testami i obserwowalnym zachowaniem systemu. Bez tego zespół dostaje szybkość generowania, ale nie pewność rezultatu.

Błędy po merge i czas review rozstrzygną spór

Rzetelna ocena musi wyjść poza liczbę pull requestów. Trzeba mierzyć regresje po wdrożeniu, czas review, liczbę zwróconych zmian oraz czas potrzebny na zrozumienie cudzego kodu wygenerowanego przez agenta.

Jeśli te koszty będą rosły wolniej niż dostarczana wartość, coding agents realnie wzmocnią zespół. Jeśli tylko szybciej zapełnią kolejkę review, dostarczyły silnik bez hamulców.

Werdykt Lilith

Coding agent potrafi zapełnić tory szybciej, niż zespół przestawi zwrotnice. Wygra załoga, która zauważy zły kierunek przed zderzeniem, a nie najszybszy generator.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗ ↗