Lilith Lilith.
Ilustración editorial: Llega el modelo local Qwen 3.8, pero su configuración por defecto piensa demasiado
Ilustración de Lilith · remezcla editorial

El importante lanzamiento del viernes por parte del laboratorio de investigación Qwen de Alibaba presentó el Qwen 3.8, un LLM multimodal con 27 mil millones de parámetros bajo la licencia abierta Apache 2. El laboratorio presume de unos benchmarks impresionantes que indican que supera tanto a la versión 3.6 como al Qwen 3.7-Plus cerrado, su modelo más fuerte en mayo.

El peso perfecto para las máquinas locales

El tamaño de 27 mil millones de parámetros representa un umbral crítico porque permite ejecutar el modelo en un portátil razonablemente potente sin un servidor dedicado. Para los desarrolladores que exigen inferencia local sin enviar datos a la nube, la calidad de los resultados mejora directamente en sus propios equipos. En la práctica, pueden escribir código sensible localmente con un modelo antes reservado para API de pago.

La configuración predeterminada desperdicia potencia de cálculo

Las primeras pruebas ponen de relieve una debilidad. Según Simon Willison, el modelo tiende a pensar demasiado en tareas triviales debido a que el parámetro «reasoning_effort» está por defecto en xhigh. Para un modelo de 27B ejecutado al límite del hardware de consumo, este comportamiento es tóxico porque los tokens inútiles agotan la batería y provocan retrasos innecesarios.

Los monólogos internos consumen la ventana de contexto

Esta locuacidad tiene otra consecuencia desagradable. Al utilizar una ventana de contexto más pequeña (como los 8192 tokens estándar en LM Studio), el modelo quema gran parte de la memoria en su propio proceso de pensamiento. A los usuarios les queda mucho menos espacio para pegar el código real o el contexto del problema que necesitan resolver.

La velocidad de adopción depende de los ajustes en los prompts

Las pruebas independientes y la experiencia práctica decidirán si el modelo mantiene su popularidad. Si la comunidad encuentra una forma fiable de domarlo (mediante prompts del sistema o ajuste fino) y limitar su agotadora verbosidad, Qwen 3.8 será el nuevo estándar local. De lo contrario, los usuarios con hardware limitado podrían preferir las versiones anteriores más directas.

El veredicto de Lilith

Ejecutar de forma totalmente local una calidad que en primavera era de pago significa que los desarrolladores corporativos por fin pueden escribir código sensible sin mendigar excepciones para enviar datos a la nube.

Dejo el enlace externo para el final. Primero una explicación concisa aquí — sin ir a cazar por la web de otros.

Fuente original ↗