Lilith.
⌕

Guía de LLM

Comparativa de modelos

Una vista práctica por uso, precio y limitaciones. Aplica filtros y abre el modelo que encaje con el trabajo concreto.

Actualizado 2026-10-08 Próxima revisión 2026-10-09 Historial de cambios →
Filtrar modelos
16 modelos
Uso
Presupuesto
Categoría

Puedes combinar filtros. Solo quedarán los modelos que cumplan todas las condiciones.

Puntos de partida sugeridos

Tres opciones para distintos tipos de trabajo. No es una clasificación de mejor a peor.

Claude Fable 5.1

recomendado
Anthropic

Resumen

Para programación, con datos verificados.

Claude Fable 5.1 registra IQ 53.4 y entrada $10/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraprocesamiento masivo de bajo coste · plazos de respuesta estrictos
53.4índice de inteligencia $10.0entrada / 1M $50.0salida / 1M

presupuesto alto si el error sale caro · tareas más exigentes · verificado con datos externos

tareas más exigentes presupuesto alto si el error sale caro programaciónagentes de IA
Detalles del modelo

DeepSeek V4.1 Flash

recomendado
DeepSeek

Resumen

Para procesamiento por lotes, con datos verificados.

DeepSeek V4.1 Flash registra IQ 39.5 y entrada $0.3/M en las fuentes. Considéralo para procesamiento por lotes, respuestas rápidas; para razonamiento de máxima dificultad, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprocesamiento por lotes · respuestas rápidas · alojamiento propio
−No recomendado pararazonamiento de máxima dificultad · programación de máxima dificultad
39.5índice de inteligencia $0.3entrada / 1M $1.2salida / 1M

modelo abierto / operación propia · especialista · verificado con datos externos

especialista modelo abierto / operación propia procesamiento por lotesrespuestas rápidas
Detalles del modelo

GLM-5.3

recomendado
Z.AI/Zhipu

Resumen

Para alojamiento propio, con datos verificados.

GLM-5.3 registra IQ 44.8 y entrada $1.4/M en las fuentes. Considéralo para alojamiento propio, entornos regulados; para agentes exigentes, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.

+Adecuado paraalojamiento propio · entornos regulados · procesamiento por lotes
−No recomendado paraagentes exigentes · programación de máxima dificultad
44.8índice de inteligencia $1.4entrada / 1M $4.4salida / 1M

modelo abierto / operación propia · especialista · verificado con datos externos

especialista modelo abierto / operación propia alojamiento propioentornos regulados
Detalles del modelo

Modelos

Una vista concisa. Las cifras, fuentes y explicaciones detalladas están en la página de cada modelo.

Claude Fable 5.1

Anthropic

Resumen

Para programación, con datos verificados.

Claude Fable 5.1 registra IQ 53.4 y entrada $10/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraprocesamiento masivo de bajo coste · plazos de respuesta estrictos
53.4índice de inteligencia $10.0entrada / 1M $50.0salida / 1M

presupuesto alto si el error sale caro · tareas más exigentes · verificado con datos externos

tareas más exigentes presupuesto alto si el error sale caro programaciónagentes de IA
Detalles del modelo

GPT-6 Astra

OpenAI

Resumen

Para programación, con datos verificados.

GPT-6 Astra registra IQ 52.7 y entrada $10/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, alojamiento propio, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · agentes de IA · imágenes y contenido multimodal
−No recomendado paraprocesamiento masivo de bajo coste · alojamiento propio · plazos de respuesta estrictos
52.7índice de inteligencia $10.0entrada / 1M $50.0salida / 1M

presupuesto alto si el error sale caro · tareas más exigentes · verificado con datos externos

tareas más exigentes presupuesto alto si el error sale caro programaciónagentes de IA
Detalles del modelo

Claude Opus 5.5

Anthropic

Resumen

Para programación, con datos verificados.

Claude Opus 5.5 registra IQ 51.2 y entrada $4/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraprocesamiento masivo de bajo coste · plazos de respuesta estrictos
51.2índice de inteligencia $4.0entrada / 1M $20.0salida / 1M

presupuesto medio · tareas más exigentes · verificado con datos externos

tareas más exigentes presupuesto medio programaciónagentes de IA
Detalles del modelo

GPT-5.6 Sol

OpenAI

Resumen

Para programación, con datos verificados.

GPT-5.6 Sol registra IQ 47 y entrada $4/M en las fuentes. Considéralo para programación, agentes de IA; para alojamiento propio, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · agentes de IA · extracción de documentos
−No recomendado paraalojamiento propio · plazos de respuesta estrictos
47.0índice de inteligencia $4.0entrada / 1M $20.0salida / 1M

presupuesto medio · tareas más exigentes · verificado con datos externos

tareas más exigentes presupuesto medio programaciónagentes de IA
Detalles del modelo

Grok 4.7

xAI

Resumen

Para programación, con datos verificados.

Grok 4.7 registra IQ 46.3 y entrada $2/M en las fuentes. Considéralo para programación, respuestas rápidas; para alojamiento propio, entornos regulados, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · respuestas rápidas · extracción de documentos
−No recomendado paraalojamiento propio · entornos regulados
46.3índice de inteligencia $2.0entrada / 1M $6.0salida / 1M

presupuesto medio · tareas más exigentes · verificado con datos externos

tareas más exigentes presupuesto medio programaciónrespuestas rápidas
Detalles del modelo

Qwen3.8 Max

Alibaba

Resumen

Para contenido multilingüe, con datos verificados.

Qwen3.8 Max registra IQ 45.4 y entrada $2/M en las fuentes. Considéralo para contenido multilingüe, programación; para alojamiento propio, agentes exigentes, realiza otra evaluación antes de desplegarlo.

+Adecuado paracontenido multilingüe · programación · procesamiento por lotes
−No recomendado paraalojamiento propio · agentes exigentes
45.4índice de inteligencia $2.0entrada / 1M $6.0salida / 1M

presupuesto medio · especialista · verificado con datos externos

especialista presupuesto medio contenido multilingüeprogramación
Detalles del modelo

GLM-5.3

Z.AI/Zhipu

Resumen

Para alojamiento propio, con datos verificados.

GLM-5.3 registra IQ 44.8 y entrada $1.4/M en las fuentes. Considéralo para alojamiento propio, entornos regulados; para agentes exigentes, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.

+Adecuado paraalojamiento propio · entornos regulados · procesamiento por lotes
−No recomendado paraagentes exigentes · programación de máxima dificultad
44.8índice de inteligencia $1.4entrada / 1M $4.4salida / 1M

modelo abierto / operación propia · especialista · verificado con datos externos

especialista modelo abierto / operación propia alojamiento propioentornos regulados
Detalles del modelo

DeepSeek V4.1 Flash

DeepSeek

Resumen

Para procesamiento por lotes, con datos verificados.

DeepSeek V4.1 Flash registra IQ 39.5 y entrada $0.3/M en las fuentes. Considéralo para procesamiento por lotes, respuestas rápidas; para razonamiento de máxima dificultad, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprocesamiento por lotes · respuestas rápidas · alojamiento propio
−No recomendado pararazonamiento de máxima dificultad · programación de máxima dificultad
39.5índice de inteligencia $0.3entrada / 1M $1.2salida / 1M

modelo abierto / operación propia · especialista · verificado con datos externos

especialista modelo abierto / operación propia procesamiento por lotesrespuestas rápidas
Detalles del modelo

Gemini 3.6 Flash

Google

Resumen

Para procesamiento por lotes, con datos verificados.

Gemini 3.6 Flash registra IQ 34 y entrada $0.75/M en las fuentes. Considéralo para procesamiento por lotes, conocimiento de la empresa; para desarrollo complejo, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprocesamiento por lotes · conocimiento de la empresa · respuestas rápidas
−No recomendado paradesarrollo complejo · plazos de respuesta estrictos
34.0índice de inteligencia $0.75entrada / 1M $3.75salida / 1M

bajo coste a gran escala · especialista · verificado con datos externos

especialista bajo coste a gran escala procesamiento por lotesconocimiento de la empresa
Detalles del modelo

DeepSeek V4 Pro 0813

DeepSeek

Resumen

Para procesamiento por lotes, con datos verificados.

DeepSeek V4 Pro 0813 registra IQ 36 y entrada $1.32/M en las fuentes. Considéralo para procesamiento por lotes, programación; para controles y auditoría de empresa, agentes exigentes, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprocesamiento por lotes · programación · alojamiento propio
−No recomendado paracontroles y auditoría de empresa · agentes exigentes
36.0índice de inteligencia $1.32entrada / 1M $3.96salida / 1M

modelo abierto / operación propia · especialista · verificado con datos externos

especialista modelo abierto / operación propia procesamiento por lotesprogramación
Detalles del modelo

Command A+

Cohere

Resumen

Para conocimiento de la empresa, con datos verificados.

Command A Plus registra IQ 13.1 y entrada $0/M en las fuentes. Considéralo para conocimiento de la empresa, extracción de documentos; para programación de máxima dificultad, razonamiento de máxima dificultad, realiza otra evaluación antes de desplegarlo.

+Adecuado paraconocimiento de la empresa · extracción de documentos · entornos regulados
−No recomendado paraprogramación de máxima dificultad · razonamiento de máxima dificultad
13.1índice de inteligencia $0.0entrada / 1M $0.0salida / 1M

bajo coste a gran escala · especialista · verificado con datos externos

especialista bajo coste a gran escala conocimiento de la empresaextracción de documentos
Detalles del modelo

Llama 4 Maverick

Meta

Resumen

Para alojamiento propio, con datos verificados.

Llama 4 Maverick registra IQ 10 y entrada $0.25/M en las fuentes. Considéralo para alojamiento propio, entornos regulados; para comodidad de una API gestionada, razonamiento de máxima dificultad, realiza otra evaluación antes de desplegarlo.

+Adecuado paraalojamiento propio · entornos regulados · conocimiento de la empresa
−No recomendado paracomodidad de una API gestionada · razonamiento de máxima dificultad
10.0índice de inteligencia $0.25entrada / 1M $0.87salida / 1M

modelo abierto / operación propia · especialista · verificado con datos externos

especialista modelo abierto / operación propia alojamiento propioentornos regulados
Detalles del modelo

Kimi K3

Moonshot

Resumen

Para programación, con datos verificados.

Kimi K3 registra IQ 43.6 y entrada $3/M en las fuentes. Considéralo para programación, procesamiento por lotes; para controles y auditoría de empresa, uso fiable de herramientas, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · procesamiento por lotes · conocimiento de la empresa
−No recomendado paracontroles y auditoría de empresa · uso fiable de herramientas
43.6índice de inteligencia $3.0entrada / 1M $15.0salida / 1M

presupuesto medio · especialista · verificado con datos externos

especialista presupuesto medio programaciónprocesamiento por lotes
Detalles del modelo

Claude Sonnet 5.5

Anthropic

Resumen

Para programación, con datos verificados.

Claude Sonnet 5.5 registra IQ 40.8 y entrada $2/M en las fuentes. Considéralo para programación, agentes de IA; para alojamiento propio, procesamiento masivo de bajo coste, realiza otra evaluación antes de desplegarlo.

+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraalojamiento propio · procesamiento masivo de bajo coste
40.8índice de inteligencia $2.0entrada / 1M $10.0salida / 1M

presupuesto medio · especialista · verificado con datos externos

especialista presupuesto medio programaciónagentes de IA
Detalles del modelo

Gemini 3.1 Pro Preview

Google

Resumen

Para conocimiento de la empresa, con datos verificados.

Gemini 3.1 Pro Preview registra IQ 29.7 y entrada $2/M en las fuentes. Considéralo para conocimiento de la empresa, imágenes y contenido multimodal; para plazos de respuesta estrictos, alojamiento propio, realiza otra evaluación antes de desplegarlo.

+Adecuado paraconocimiento de la empresa · imágenes y contenido multimodal · contenido multilingüe
−No recomendado paraplazos de respuesta estrictos · alojamiento propio
29.7índice de inteligencia $2.0entrada / 1M $12.0salida / 1M

presupuesto medio · especialista · verificado con datos externos

especialista presupuesto medio conocimiento de la empresaimágenes y contenido multimodal
Detalles del modelo

Mistral Medium 3.5

Mistral AI

Resumen

Para entornos regulados, con datos verificados.

Mistral Medium 3.5 registra IQ 14.2 y entrada $1.5/M en las fuentes. Considéralo para entornos regulados, conocimiento de la empresa; para razonamiento de máxima dificultad, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.

+Adecuado paraentornos regulados · conocimiento de la empresa · extracción de documentos
−No recomendado pararazonamiento de máxima dificultad · programación de máxima dificultad
14.2índice de inteligencia $1.5entrada / 1M $7.5salida / 1M

presupuesto medio · especialista · verificado con datos externos

especialista presupuesto medio entornos reguladosconocimiento de la empresa
Detalles del modelo
Cómo se recopilan los datos

Selección de modelos actualizada a diario. Compruebo los precios y el Intelligence Index con datos recientes de Artificial Analysis; los demás benchmarks indican sus propias fuentes. Un cambio de metodología puede alterar la puntuación sin que cambie el modelo, por lo que los índices de distintas fechas no siempre son comparables. Si falla la validación, se conserva la última versión verificada con su fecha original.