Lilith Lilith.
⌕
Ilustración editorial: Claude Sonnet 5.5 acelera más de un 30 %, pero effort sigue marcando la factura
Ilustración de Lilith · remezcla editorial

Anthropic ha lanzado Claude Sonnet 5.5 con el mismo precio de API que Sonnet 5: 2 dólares por millón de tokens de entrada y 10 dólares por millón de tokens de salida. La empresa afirma que funciona más de un 30 % más rápido y que reduce hasta un 30 % el coste de la mayoría de las tareas.

La misma tarifa por token compra trabajo terminado antes

La mejora no procede de un token más barato. Anthropic sostiene que el modelo emplea menos tokens por tarea y responde más deprisa, lo que reduce el coste del trabajo completado. Sonnet 5.5 está disponible en Claude API como claude-sonnet-5-5 y también es el modelo del plan gratuito de claude.ai.

Una prueba práctica de Simon Willison mostró una excepción importante. Con thinking effort en max, el modelo consumió 128.000 tokens, costó 1,28 dólares y no produjo el SVG solicitado. Con xhigh terminó una tarea similar en 41 segundos por 5,74 centavos.

Los equipos deben calcular el precio del resultado

Para producto e ingeniería importa el rendimiento del workflow completo. Un modelo un 30 % más rápido puede reducir esperas en code review, procesos por lotes y bucles de agentes, siempre que también consuma menos tokens.

El acceso gratuito ofrece a Anthropic un canal de distribución más amplio para un modelo de trabajo competente. Los usuarios pueden comprobar su calidad sin pagar y las empresas obtienen una ruta más barata desde el prototipo hasta el despliegue mediante API.

El effort máximo puede devorar el ahorro prometido

La prueba de Willison explica por qué cambiar el nombre del modelo en la configuración no basta. Un effort alto puede alargar la búsqueda, gastar la ventaja y acabar sin un resultado útil. Los benchmarks del proveedor tampoco predicen el comportamiento en un repositorio, unos datos y unas herramientas concretas.

La telemetría de producción revelará el coste real

Los equipos deberían comparar Sonnet 5 y 5.5 con tareas idénticas y medir aciertos, latencia, tokens por trabajo terminado e intervención humana. La señal válida será una reducción sostenida del coste por resultado, no un benchmark brillante ni un pelícano en bicicleta bien dibujado.

El veredicto de Lilith

Sonnet 5.5 puede hacer pasar más trabajo terminado por la misma tubería. Quien deje effort al máximo sin medirlo verá correr el taxímetro mientras el modelo aún busca el manillar de la bicicleta del pelícano.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗ ↗