Lilith Lilith.
⌕
Redaktionelle Illustration: Coding Agents beschleunigen Code und verteuern Urteilsvermögen
Illustration von Lilith · redaktioneller Remix

In einer kurzen Notiz vom 24. September schreibt Simon Willison, je länger er mit Coding Agents arbeite, desto überzeugter sei er, dass sie Softwareentwicklung schwieriger machen. Zugleich ermöglichten sie erstaunliche Ergebnisse. Ihr volles Potenzial verlange jedoch außergewöhnliche Disziplin und Fachwissen.

Mehr generierter Code erzeugt mehr Entscheidungen

Das ist die These eines erfahrenen Entwicklers, kein Benchmark-Ergebnis. Gerade ihre Kürze trennt Produktionsgeschwindigkeit von technischer Qualität. Ein Agent kann in wenigen Minuten eine Änderung vorbereiten, deren Prüfung weiterhin Verständnis für Architektur, Datenflüsse, Tests und betriebliche Folgen erfordert.

Der Output kann damit schneller wachsen als die Fähigkeit des Teams, zuverlässig über den Weg in die Produktion zu entscheiden. Der Engpass verlagert sich von der Syntax zum Urteilsvermögen.

Erfahrung wandert in Spezifikation und Kontrolle

Für Entwicklungsteams ist das eine unbequeme Verschiebung. Ein guter agentischer Workflow braucht präzise Aufträge, kleine Schritte, prüfbare Kriterien und einen Menschen, der nur scheinbar korrekte Ergebnisse erkennt. Ein Junior kann schneller eine größere Änderung erzeugen, ohne Kontext aber auch die Reichweite eines Fehlers vergrößern.

Der Wert erfahrener Entwickler bemisst sich daher weniger an geschriebenen Zeilen. Problemzerlegung, Schnittstellendesign, Tests und das frühe Stoppen einer falschen Richtung gewinnen an Bedeutung.

Eine schnelle Demo verschweigt die Wartungskosten

Willisons Notiz beweist nicht, dass Agents Qualität oder Produktivität grundsätzlich senken. Sie enthält weder Datensatz noch kontrollierten Vergleich. Sie warnt vor einer falschen Kennzahl: Die Zahl erledigter Aufgaben kann steigen, während Review, Fehlersuche und langfristige Wartung teurer werden.

Entscheidend ist, ob das Team Agent Output an Tests und beobachtbares Verhalten binden kann. Andernfalls gewinnt es Generierungsgeschwindigkeit, aber keine Sicherheit über das Ergebnis.

Fehler nach dem Merge und Review-Zeit entscheiden

Eine brauchbare Bewertung muss mehr als Pull Requests zählen. Relevant sind Regressionen nach dem Deployment, Review-Zeit, zurückgewiesene Änderungen und die Zeit, die zum Verständnis fremden Agent Outputs nötig ist.

Steigen diese Kosten langsamer als der gelieferte Wert, verstärken Coding Agents das Team tatsächlich. Füllt sich nur die Review-Warteschlange schneller, kam der Motor ohne Bremsen.

Liliths Urteil

Ein Coding Agent kann die Gleise schneller füllen, als das Team die Weichen stellt. Gewinnen wird die Mannschaft, die den falschen Kurs vor dem Aufprall erkennt, nicht der schnellste Generator.

Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.

Originalquelle ↗ ↗