2026-09-28 · ← Noticias
Claude Sonnet 5.5 acelera más de un 30 % y compite por coste de tarea, no de token
Anthropic ha lanzado Claude Sonnet 5.5 como complemento más rápido y económico de Opus 5.5. Mantiene las tarifas de Sonnet 5, pero la empresa afirma que completa la mayoría del trabajo con menos tokens y genera resultados más de un 30 % más rápido.
Las mismas tarifas esconden un menor coste por tarea terminada
Sonnet 5.5 cuesta 2 dólares por millón de tokens de entrada, 10 dólares por millón de tokens de salida y 0,20 dólares por millón de tokens leídos de cache. En las pruebas de Anthropic, el coste por tarea fue hasta un 30 % inferior al de Sonnet 5.
El modelo obtuvo un 70,6 % en Terminal-Bench 4.0 frente al 10,3 % de su predecesor. Con effort Max logró un 46,2 % en FrontierCode 1.1 y un 55,5 % en CursorBench 4.0. Está disponible en Claude Platform como claude-sonnet-5-5 y a través de AWS, Google Cloud y Microsoft Azure.
La eficiencia de un agente se mide en trabajo terminado
Para coding agents, menos tool calls y una ruta más corta pueden pesar más que las diferencias de tarifa. Un modelo con el mismo precio por token resulta más barato si repite menos búsquedas, se pierde menos en el repositorio y completa más tareas sin intervención humana.
Anthropic sitúa Sonnet en el trabajo rutinario y bien delimitado, mientras reserva Opus 5.5 para tareas abiertas que exigen juicio sostenido. Para los equipos de producto es una guía de routing, no una razón automática para sustituir un modelo en todas partes.
El gran salto del benchmark sigue siendo una cifra del fabricante
Los números comparan distintos effort settings y algunos evals se realizaron sobre un despliegue previo al lanzamiento. Anthropic reconoce que Opus sigue siendo superior en trabajos complejos y abiertos. Sonnet 5.5 también incorpora nuevos safeguards de ciberseguridad y puede volver a Sonnet 5 ante tareas de mayor riesgo.
Los evals internos dirán si el 30 % llega a producción
Los equipos deberían comparar el coste completo de la tarea, el tiempo hasta aceptar un cambio, las intervenciones humanas y los tool calls fallidos. Solo el mismo workflow con datos propios mostrará si generar más rápido equivale a entregar antes.
El veredicto de Lilith
Sonnet 5.5 no cambió la etiqueta de precio del token, sino que acortó el camino hasta la caja. Si los evals internos confirman menos pasos e intervenciones humanas, los contables lo verán antes que los aficionados a los benchmarks.
Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.
Fuente original ↗ ↗