2026-09-28 · ← News
Claude Sonnet 5.5 ist über 30 % schneller und greift die Aufgabenkosten an
Anthropic hat Claude Sonnet 5.5 als schnellere und wirtschaftlichere Ergänzung zu Opus 5.5 veröffentlicht. Die Preise bleiben gegenüber Sonnet 5 unverändert. Das Unternehmen behauptet jedoch, das Modell erledige die meisten Aufgaben mit weniger Tokens und erzeuge Ausgaben über 30 % schneller.
Gleiche Tokenpreise verbergen niedrigere Kosten pro fertiger Aufgabe
Sonnet 5.5 kostet 2 Dollar pro Million Input Tokens, 10 Dollar pro Million Output Tokens und 0,20 Dollar pro Million aus dem Cache gelesener Tokens. In Anthropics eigenen Tests lagen die Kosten pro Aufgabe bis zu 30 % unter Sonnet 5.
Das Modell erreichte 70,6 % in Terminal-Bench 4.0 gegenüber 10,3 % beim Vorgänger. Bei Max Effort erzielte es 46,2 % in FrontierCode 1.1 und 55,5 % in CursorBench 4.0. Es ist auf der Claude Platform als claude-sonnet-5-5 sowie über AWS, Google Cloud und Microsoft Azure verfügbar.
Agenteneffizienz misst fertige Arbeit statt billiger Tokens
Bei Coding Agents können weniger Tool Calls und ein kürzerer Lösungsweg Preisunterschiede überwiegen. Ein Modell mit gleichem Tokenpreis ist günstiger, wenn es Suchen seltener wiederholt, weniger durch ein Repository irrt und mehr Aufgaben ohne menschlichen Eingriff abschließt.
Anthropic positioniert Sonnet für routinemäßige, klar abgegrenzte Arbeit. Opus 5.5 bleibt für offene Aufgaben mit anhaltendem Urteilsvermögen vorgesehen. Für Produktteams ist das eine Routing Empfehlung und kein automatischer Grund, überall das Modell zu wechseln.
Der große Benchmarksprung stammt weiterhin vom Hersteller
Die Zahlen vergleichen verschiedene Effort Settings. Einige Evals liefen zudem auf einer Vorabversion. Anthropic räumt selbst ein, dass Opus bei komplexen offenen Aufgaben stärker bleibt. Wegen höherer Cyberfähigkeiten nutzt Sonnet 5.5 neue Safeguards und kann bei riskanten Aufgaben auf Sonnet 5 zurückfallen.
Interne Evals zeigen, ob 30 % die Produktion überstehen
Teams sollten vollständige Aufgabenkosten, Zeit bis zur akzeptierten Änderung, menschliche Eingriffe und fehlgeschlagene Tool Calls vergleichen. Erst derselbe Workflow mit eigenen Daten zeigt, ob schnellere Generierung auch schnelleres Ausliefern bedeutet.
Liliths Urteil
Sonnet 5.5 hat das Preisschild am Token nicht ausgetauscht, sondern den Weg zur Kasse verkürzt. Bestätigen interne Evals weniger Schritte und menschliche Eingriffe, merken es die Buchhalter vor den Benchmark Fans.
Den externen Link hebe ich mir für den Schluss auf. Erst eine knappe Erklärung hier — ohne Jagd über fremde Websites.
Originalquelle ↗ ↗