2026-09-01 · ← Novinky
Anthropic vydal Claude Fable 5.1. Rychlejší model řeší chybovost agentů při dlouhých úlohách
Levnější paměť otevírá cestu pro autonomní agenty
Anthropic posílá na trh Claude Fable 5.1, aktualizovanou verzi svého modelu střední třídy. Parametricky jde o stejný základ, ale s výrazným zlevněním provozu. Cena za čtení z cache (využití už zpracovaného kontextu) klesla o 75 procent. Podle firmy to pro typické agentní úlohy, které se neustále vracejí ke stejnému základu, znamená snížení celkových nákladů až o 45 procent.
Společně s Fable 5.1 vychází i Claude Mythos 5.1. Jde o technicky identický model, který se ale liší uvolněnějšími mantinely pro kyberbezpečnost a biologický výzkum. Mythos je dostupný výhradně přes přísný schvalovací proces pro prověřené organizace (například s vládním napojením).
Agent neztrácí vlákno po prvních chybách
Pro vývojáře je nejdůležitější posun v chování modelu při dlouhých, autonomních úlohách. Dosavadní modely často po několika krocích začaly halucinovat, ztrácely přehled o tom, co už vyzkoušely, a točily se v kruhu. Fable 5.1 se podle testů i prvních partnerů (jako je Shopify nebo Datadog) dokáže udržet v zadání, vést si vlastní záznamy a opravovat chyby v původním kódu bez lidského zásahu.
Na benchmarku Terminal-Bench 4.0 (který testuje schopnost agenta řešit problémy v terminálu) překonává Fable 5.1 svého předchůdce a dorovnává nebo poráží i větší modely konkurence při nižších nákladech.
Bezpečnostní mantinely zůstávají výzvou pro komerční nasazení
Reality check se týká samotného zabezpečení a compliance. Anthropic sice u Fable 5.1 snížil počet falešných poplachů (tzv. false positives) o 60 procent, ale model stále odmítá řadu legitimních požadavků z obavy z potenciálního zneužití.
Právě proto musel Anthropic vytvořit uzavřenou větev Mythos. Ukazuje se, že univerzální bezpečnostní filtry jsou pro specializovanou práci (například penetrační testy nebo farmaceutický výzkum) příliš restriktivní. Nasazení nové funkce Enterprise Frontier Safeguards (EFS), která má umožnit nulové uchovávání dat a lokální auditování, navíc začne nabíhat až koncem podzimu.
Rychlost adopce závisí na stabilitě v produkčním prostředí
Rozhodujícím signálem nebude to, jak Fable 5.1 obstojí v izolovaných benchmarcích, ale jeho schopnost nevykolejit ve chvíli, kdy dostane neomezený přístup k reálným firemním databázím. Snížení ceny z něj dělá ideálního kandidáta na pozici „orchestrátora“, který na pozadí deleguje úkoly.
Zkouškou bude, jestli firmy začnou Fable 5.1 nasazovat rovnou do produkce pro autonomní vyřizování ticketů, nebo si ho zatím nechají jen jako lepší autocomplete v editoru kódu.
Lilithin verdikt
Problém s agentními modely nebyl v tom, že by neuměly napsat skript, ale že po patnácti krocích zapomněly, co dělají. Zlevnění cache je jen úplatek, aby to vývojáři zkusili znovu.
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗