Lilith.
⌕
Redaktionelle Illustration: Haiku 5.5 senkt den Preis kurzer Aufgaben um 90 %, langer Kontext kostet extra
Illustration von Lilith · redaktioneller Remix

Anthropic veröffentlicht Claude Haiku 5.5 als schnelles Modell für große Mengen kurzer Aufgaben. Unterhalb von 100.000 Tokens sinkt der Preis gegenüber Haiku 4.5 um 90 %, zugleich führt der neue Tarif eine harte Grenze ein, die die Kosten langer Agentenläufe verändern kann.

Haiku 5.5 kostet unter 100.000 Tokens nur ein Zehntel des Vorgängers

Anthropic verlangt 0,10 Dollar je Million Input Tokens und 0,50 Dollar je Million Output Tokens. Oberhalb von 100.000 Prompt Tokens steigen die Preise auf 0,50 und 2,50 Dollar. Nach Angaben des Unternehmens lagen rund 90 % der Haiku 4.5 Anfragen unter dieser Grenze, im Durchschnitt sollen Workloads etwa 75 % weniger kosten.

Das Modell bietet ein einstellbares Effort Niveau und verwendet standardmäßig medium. Anthropic stellt es auf der Claude Platform sowie über Amazon Web Services, Google Cloud und Microsoft Azure bereit. Für komplexes agentisches Programmieren empfiehlt das Unternehmen weiterhin Sonnet 5.5 und Opus 5.5.

Die beste Rolle ist ein günstiger Arbeiter im Hintergrund

Haiku 5.5 zielt auf Zusammenfassungen, Klassifikation, Datenbankabfragen, Support und klar begrenzte Subagentenaufgaben. Dort erlaubt der niedrige Preis häufigere Aufrufe oder die Aufteilung der Arbeit auf mehrere spezialisierte Läufe.

Für Teams ist zuverlässiges Routing wichtiger als ein einziges Universalmodell. Ein stärkeres Modell kann planen, während Haiku wiederkehrende Schritte erledigt. Die Ersparnis entsteht dann durch die Architektur des Workflows und nicht nur durch einen billigeren Tarif.

Ein längerer Prompt löscht einen großen Teil des Preisvorteils

Simon Willison weist darauf hin, dass sich der Preis oberhalb von 100.000 Tokens verfünffacht. In seinem Test verbrauchte derselbe lange Prompt wegen des neuen Tokenizers außerdem etwa 1,25 Mal so viele Tokens wie bei Haiku 4.5. Ein Rabatt im Tarif ist daher nicht automatisch ein niedrigerer Preis pro erledigter Aufgabe.

Die Benchmarks stammen vom Anbieter, und das reale Ergebnis hängt von Effort, Kontextlänge, Cache und Wiederholungen ab. Ein billigeres Token hilft nicht, wenn das kleinere Modell dieselbe Arbeit mehrfach ausführen muss.

Interne Evals müssen die Kosten der fertigen Aufgabe messen

Entscheidend wird der Preis pro erfolgreichem Fall sein, nicht die Rate je Million Tokens. Teams sollten kurze Routineaufgaben, lange Prompts und Läufe mit Eskalation zu Sonnet oder Opus getrennt messen.

Hält Haiku 5.5 bei niedrigem Effort und kurzem Kontext die Qualität, kann es Subagenten deutlich verbilligen. Überschreitet der Kontext regelmäßig 100.000 Tokens, schrumpft der Vorteil schnell.

Liliths Urteil

Haiku 5.5 ist ein günstiger Kurzstreckenläufer, dessen Maut nach 100.000 Tokens stark steigt. Wer ihm ohne Messung ein ganzes Archiv auflädt, kann im Ziel eine völlig andere Rechnung vorfinden.

Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.

Originalquelle ↗ ↗