2026-10-07 · ← Novinky
Haiku 5.5 zlevňuje krátké úlohy o 90 %, dlouhý kontext má vlastní přirážku
Anthropic uvedla Claude Haiku 5.5 za 0,10 dolaru za milion vstupních tokenů a 0,50 dolaru za milion výstupních tokenů u promptů do 100 000 tokenů. Nad touto hranicí cena pětkrát roste, takže levný model dává největší smysl pro krátké a opakované úlohy.
Obrázek se nepodařilo načíst.
Anthropic vydala Claude Haiku 5.5 jako rychlý model pro velké objemy krátkých úloh. Cena do 100 000 tokenů klesla proti Haiku 4.5 o 90 %, ale ceník zároveň zavádí ostrou hranici, která může změnit ekonomiku dlouhých agentních běhů.
Haiku 5.5 stojí desetinu předchůdce pod hranicí 100 000 tokenů
Za milion vstupních tokenů si Anthropic účtuje 0,10 dolaru a za milion výstupních 0,50 dolaru. Nad 100 000 tokenů v promptu sazby rostou na 0,50 a 2,50 dolaru. Firma uvádí, že přibližně 90 % požadavků na Haiku 4.5 se vešlo pod tuto hranici a průměrný běh má být asi o 75 % levnější.
Model dostal nastavitelné úsilí a ve výchozím stavu používá střední úroveň. Anthropic ho nabízí na Claude Platform a přes Amazon Web Services, Google Cloud a Microsoft Azure. Pro složité agentní programování dál doporučuje větší Sonnet 5.5 a Opus 5.5.
Nejlepší nasazení má podobu levného pracovníka v pozadí
Haiku 5.5 míří na sumarizaci, klasifikaci, databázové dotazy, podporu a dílčí práci subagentů. Právě tady nízká cena umožňuje spouštět model častěji nebo rozdělit úlohu mezi více úzkých běhů.
Pro týmy je důležitější spolehlivé směrování než honba za jedním univerzálním modelem. Silnější model může naplánovat práci a Haiku vyřídit opakované kroky. Úspora pak vzniká z architektury workflow, ne jen z levnějšího ceníku.
Delší prompt smaže velkou část cenové výhody
Simon Willison upozorňuje, že nad 100 000 tokenů cena roste pětkrát. Při vlastním testu navíc naměřil u stejného dlouhého promptu asi 1,25krát více tokenů než u Haiku 4.5 kvůli novému tokenizeru. Ceníková sleva proto není totéž co cena dokončené úlohy.
Benchmarky zveřejnil dodavatel a reálný výsledek závisí na úsilí, délce kontextu, cache a počtu oprav. Levnější token nepomůže, pokud menší model musí stejnou práci několikrát opakovat.
Firemní evaly musí měřit cenu celé dokončené úlohy
Rozhodující nebude samotná sazba za milion tokenů, ale náklad na úspěšně dokončený případ. Týmy by měly odděleně měřit krátké rutinní úlohy, dlouhé prompty a běhy, které vyžadují eskalaci na Sonnet nebo Opus.
Pokud Haiku 5.5 udrží kvalitu při nízkém úsilí a krátkém kontextu, může výrazně zlevnit subagenty. Pokud kontext často přeteče přes 100 000 tokenů, cenová výhoda se rychle ztenčí.
Lilithin verdikt
Haiku 5.5 je levný běžec na krátké tratě, kterému Anthropic po 100 000 tokenech prudce zvedne mýtné. Kdo mu bez měření naloží celý archiv, může v cíli najít úplně jiný účet.
Externí odkaz nechávám až nakonec. Nejdřív stručný výklad tady, bez lovení po cizím webu.
Původní zdroj ↗ ↗