Lilith.
⌕
Ilustracja redakcyjna: Haiku 5.5 obniża cenę krótkich zadań o 90 %, ale długi kontekst ma dopłatę
Ilustracja Lilith · remiks redakcyjny

Anthropic wydało Claude Haiku 5.5 jako szybki model do dużej liczby krótkich zadań. Cena poniżej 100 000 tokenów spadła o 90 % względem Haiku 4.5, ale nowy cennik wprowadza też ostrą granicę, która może zmienić ekonomię długich przebiegów agentów.

Haiku 5.5 kosztuje jedną dziesiątą ceny poprzednika poniżej 100 000 tokenów

Anthropic pobiera 0,10 dolara za milion tokenów wejściowych i 0,50 dolara za milion tokenów wyjściowych. Powyżej 100 000 tokenów w prompcie stawki rosną do 0,50 i 2,50 dolara. Firma podaje, że około 90 % zapytań do Haiku 4.5 mieściło się poniżej tego progu, a przeciętny przebieg ma kosztować około 75 % mniej.

Model otrzymał regulowany poziom effort, domyślnie ustawiony na medium. Anthropic udostępnia go na Claude Platform oraz przez Amazon Web Services, Google Cloud i Microsoft Azure. Do złożonego programowania agentowego nadal poleca większe modele Sonnet 5.5 i Opus 5.5.

Najlepszą rolą jest tani wykonawca pracujący w tle

Haiku 5.5 jest przeznaczony do podsumowań, klasyfikacji, zapytań do baz danych, obsługi klienta i wąskich zadań subagentów. Przy takich zastosowaniach niska cena pozwala częściej uruchamiać model albo dzielić pracę między kilka wyspecjalizowanych wywołań.

Dla zespołów ważniejsze od jednego uniwersalnego modelu jest niezawodne kierowanie zadań. Mocniejszy model może planować, a Haiku wykonywać powtarzalne kroki. Oszczędność wynika wtedy z architektury workflow, a nie tylko z niższej stawki.

Dłuższy prompt odbiera znaczną część przewagi cenowej

Simon Willison zwraca uwagę, że powyżej 100 000 tokenów cena rośnie pięciokrotnie. W jego teście ten sam długi prompt zużył też około 1,25 raza więcej tokenów niż w Haiku 4.5 z powodu nowego tokenizera. Rabat w cenniku nie musi więc oznaczać niższego kosztu ukończonego zadania.

Benchmarki opublikował dostawca, a wynik w produkcji zależy od effort, długości kontekstu, cache i liczby ponowień. Tańszy token nie pomoże, jeśli mniejszy model musi kilka razy powtarzać tę samą pracę.

Firmowe evals muszą liczyć koszt ukończonego zadania

Najważniejszą metryką będzie koszt udanego przypadku, a nie cena miliona tokenów. Zespoły powinny osobno mierzyć krótkie rutynowe zadania, długie prompty oraz przebiegi wymagające eskalacji do Sonnet lub Opus.

Jeśli Haiku 5.5 utrzyma jakość przy niskim effort i krótkim kontekście, może znacznie obniżyć koszt subagentów. Jeśli kontekst często przekroczy 100 000 tokenów, przewaga szybko się skurczy.

Werdykt Lilith

Haiku 5.5 jest tanim biegaczem na krótkim dystansie, któremu po 100 000 tokenów gwałtownie rośnie opłata za przejazd. Kto bez pomiaru załaduje mu całe archiwum, może na mecie zobaczyć zupełnie inny rachunek.

Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.

Oryginalne źródło ↗ ↗