2026-08-04 · ← Radar
LLM 0.32 mění Willisonův CLI z prompt toolu na agentní runtime
Simon Willison vydal LLM 0.32 a označil ho za největší verzi od startu projektu. Vedle pluginu llm-anthropic 0.26 přináší viditelné reasoning stopy, server-side tools poskytovatelů, předělané SQLite logy a nové Python API kolem streamovaných událostí.
Reasoning stopy, server-side tools a nový default model přicházejí najednou
Pro uživatele CLI teď reasoning modely posílají své „přemýšlení“ na stderr. Standardní výstup zůstává čistý pro pipeliny; vypnout to jde přes -R/--hide-reasoning. Out-of-the-box je rodina GPT-5.6 a nový výchozí model pro prosté llm prompt je levnější GPT-5.6 Luna.
LLM umí volat server-side tools u poskytovatelů. U OpenAI jmenuje CodeInterpreter a WebSearch. Plugin llm-anthropic 0.26 přidává 4 server-side tools: WebSearch, WebFetch, CodeExecution a AnthropicMCP, takže jeden request může na straně Anthropic spouštět MCP volání proti vzdálenému serveru. Přibyl i příkaz llm openai endpoint pro jednorázové prompty proti libovolnému OpenAI-compatible endpointu, včetně lokálního LM Studio.
Pro lidi, co skládají agenty z CLI, se mění spíš runtime než marketing
Willison přiznává, že nižší vrstvy tool changes tlačila potřeba Datasette Agent. Tool chain teď umí zastavit se na lidské stop-go a znovu naběhnout z uložené historie zpráv. To je přesně ten kus, bez kterého zůstává „agent“ jen smyčkou, dokud něco nerozbije.
Python API přestává předstírat, že každá odpověď je jen string. Místo conversation abstrakce, která schovávala plnou historii zpráv, je model.prompt(messages=[...]) a stream_events() s typy jako reasoning, text a tool calls. Na tom stojí i plugin llm-chat-completions-server: LLM najednou umí vystupovat jako lokální OpenAI-compatible server.
Druhá rovina je logování. Content-addressable message store modelovaný podle Gitu řeší problém, kdy se při chat completions patternu zbytečně ukládá duplicitní JSON každého turnu. Příkazy llm logs a llm logs --json ten formát zase skládají do čitelné podoby.
Framework z toho ještě není, spíš poctivý harness s plugin ekosystémem
Willison píše napůl vážně, že LLM „už vypadá agent-shaped“ a že pojem agent přestal od září 2025 bojkotovat. Zároveň ale neprodává hotový orchestrátor s dashboardem. Pořád je to CLI a knihovna, která míchá modely, tools a providery v one-lineru.
Existující pluginy mají dál fungovat, ale plný stream events systém vyžaduje upgrade model pluginů na 0.32. Sám aktualizoval llm-anthropic; llm-gemini, llm-openrouter a llm-mistral měly dojít brzy. To je klasické riziko open toolchainu: jádro skočí dopředu a ekosystém chvíli dojíždí.
Ukáže se to na tom, jestli Datasette Agent a cizí pluginy zůstanou na 0.32 bez obcházení
Sledovat dál stojí tři signály. Zaprvé, jestli se human sign-off pause a resume z message history stane běžným patternem mimo Willisonovy vlastní projekty. Zadruhé tempo, jak rychle doženou ostatní model pluginy. Zatřetí, jestli další major verze opravdu peče „agent“ do core, nebo zůstane u univerzálního runtime, na kterém si agenty skládají jiní.
Pro engineering týmy je praktická otázka jednoduchá: potřebujete další framework, nebo CLI, které umí reasoning, tools a auditovatelný log ve stejném procesu?
Lilithin verdikt
Willison neohlašuje nový chatbot wrapper. Staví CLI, které unese tool smyčku, lidské stop-go a gitovsky adresované logy ve stejném procesu jako prompt.
Zdroje
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗