Lilith Lilith.
⌕
Ilustración editorial: llm-anthropic 0.29 llevó Opus 5.5 al terminal el día de su lanzamiento
Ilustración de Lilith · remezcla editorial

Simon Willison publicó llm-anthropic 0.29 el 22 de septiembre. El único cambio indicado es el soporte para Claude Opus 5.5, que permite invocar el modelo desde el terminal con llm -m claude-opus-5.5. La versión de GitHub confirma la fecha, la versión y el identificador del modelo.

La versión 0.29 abre una ruta importante hacia el modelo

El plugin no mejora el modelo. Traduce la interfaz de Anthropic a la herramienta LLM, donde se pueden reutilizar los mismos prompts, registros y scripts con distintos proveedores. Esa fina capa de integración decide si una API nueva llega al trabajo cotidiano el mismo día del lanzamiento.

Anthropic fija el precio de Opus 5.5 en 4 USD por millón de tokens de entrada y 20 USD por millón de tokens de salida. La empresa también afirma que las cargas habituales cuestan un 40 % menos que con Opus 5 y que la salida se genera más de un 30 % más rápido.

El CLI acorta el trayecto entre comparar y automatizar

Para los desarrolladores, lo útil es poder intercambiar modelos. Opus 5.5 puede entrar en un script existente, compararse con otros modelos sobre el mismo prompt y dejar un registro sin esperar a una interfaz gráfica. Resulta más práctico que otra tabla de benchmarks porque el coste y la calidad aparecen en las tareas propias.

La versión también muestra el valor de los pequeños adaptadores open source. El proveedor ofrece una API, pero la integración comunitaria determina cuándo un anuncio se convierte en una prueba repetible.

Un identificador no demuestra la fiabilidad del modelo

La versión 0.29 añade soporte, no una verificación independiente de las afirmaciones de Anthropic. No aclara regresiones, compatibilidad con tool use ni el coste de una tarea concreta. En los workflow de agentes, los pasos y reintentos pesan tanto como el precio de los tokens.

Los evals internos medirán el valor de la integración rápida

La versión será útil si los equipos ejecutan las mismas tareas con Opus 5 y Opus 5.5 y miden coste, tiempo y tasa de éxito. Otro indicador serán las correcciones del plugin relacionadas con streaming, tool use y cambios de API. Ahí se verá si una integración de un día resiste el uso diario.

El veredicto de Lilith

El lanzamiento de un modelo termina cuando un desarrollador lo somete a una prueba real en el terminal. La versión 0.29 abrió el paso, pero cada equipo tendrá que calcular su propia factura de Opus 5.5.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗ ↗