Puedes combinar filtros. Solo quedarán los modelos que cumplan todas las condiciones.
Puntos de partida sugeridos
Tres opciones para distintos tipos de trabajo. No es una clasificación de mejor a peor.
Claude Fable 5.1
recomendado
Anthropic
Resumen
Para programación, con datos verificados.
Claude Fable 5.1 registra IQ 53.4 y entrada $10/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraprocesamiento masivo de bajo coste · plazos de respuesta estrictos
53.4índice de inteligencia$10.0entrada / 1M$50.0salida / 1M
presupuesto alto si el error sale caro · tareas más exigentes · verificado con datos externos
tareas más exigentespresupuesto alto si el error sale caroprogramaciónagentes de IA
Para procesamiento por lotes, con datos verificados.
DeepSeek V4.1 Flash registra IQ 39.5 y entrada $0.3/M en las fuentes. Considéralo para procesamiento por lotes, respuestas rápidas; para razonamiento de máxima dificultad, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprocesamiento por lotes · respuestas rápidas · alojamiento propio
−No recomendado pararazonamiento de máxima dificultad · programación de máxima dificultad
39.5índice de inteligencia$0.3entrada / 1M$1.2salida / 1M
modelo abierto / operación propia · especialista · verificado con datos externos
especialistamodelo abierto / operación propiaprocesamiento por lotesrespuestas rápidas
GLM-5.3 registra IQ 44.8 y entrada $1.4/M en las fuentes. Considéralo para alojamiento propio, entornos regulados; para agentes exigentes, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.
+Adecuado paraalojamiento propio · entornos regulados · procesamiento por lotes
−No recomendado paraagentes exigentes · programación de máxima dificultad
44.8índice de inteligencia$1.4entrada / 1M$4.4salida / 1M
modelo abierto / operación propia · especialista · verificado con datos externos
Una vista concisa. Las cifras, fuentes y explicaciones detalladas están en la página de cada modelo.
Ningún modelo coincide con esta combinación. Prueba con menos filtros.
ModeloResumenAdecuado / poco adecuadoDatos
Claude Fable 5.1
Anthropic
Resumen
Para programación, con datos verificados.
Claude Fable 5.1 registra IQ 53.4 y entrada $10/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraprocesamiento masivo de bajo coste · plazos de respuesta estrictos
53.4índice de inteligencia$10.0entrada / 1M$50.0salida / 1M
presupuesto alto si el error sale caro · tareas más exigentes · verificado con datos externos
tareas más exigentespresupuesto alto si el error sale caroprogramaciónagentes de IA
GPT-6 Astra registra IQ 52.7 y entrada $10/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, alojamiento propio, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · agentes de IA · imágenes y contenido multimodal
−No recomendado paraprocesamiento masivo de bajo coste · alojamiento propio · plazos de respuesta estrictos
52.7índice de inteligencia$10.0entrada / 1M$50.0salida / 1M
presupuesto alto si el error sale caro · tareas más exigentes · verificado con datos externos
tareas más exigentespresupuesto alto si el error sale caroprogramaciónagentes de IA
Claude Opus 5.5 registra IQ 51.2 y entrada $4/M en las fuentes. Considéralo para programación, agentes de IA; para procesamiento masivo de bajo coste, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraprocesamiento masivo de bajo coste · plazos de respuesta estrictos
51.2índice de inteligencia$4.0entrada / 1M$20.0salida / 1M
presupuesto medio · tareas más exigentes · verificado con datos externos
tareas más exigentespresupuesto medioprogramaciónagentes de IA
GPT-5.6 Sol registra IQ 47 y entrada $4/M en las fuentes. Considéralo para programación, agentes de IA; para alojamiento propio, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · agentes de IA · extracción de documentos
−No recomendado paraalojamiento propio · plazos de respuesta estrictos
47.0índice de inteligencia$4.0entrada / 1M$20.0salida / 1M
presupuesto medio · tareas más exigentes · verificado con datos externos
tareas más exigentespresupuesto medioprogramaciónagentes de IA
Grok 4.7 registra IQ 46.3 y entrada $2/M en las fuentes. Considéralo para programación, respuestas rápidas; para alojamiento propio, entornos regulados, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · respuestas rápidas · extracción de documentos
−No recomendado paraalojamiento propio · entornos regulados
46.3índice de inteligencia$2.0entrada / 1M$6.0salida / 1M
presupuesto medio · tareas más exigentes · verificado con datos externos
tareas más exigentespresupuesto medioprogramaciónrespuestas rápidas
Para contenido multilingüe, con datos verificados.
Qwen3.8 Max registra IQ 45.4 y entrada $2/M en las fuentes. Considéralo para contenido multilingüe, programación; para alojamiento propio, agentes exigentes, realiza otra evaluación antes de desplegarlo.
+Adecuado paracontenido multilingüe · programación · procesamiento por lotes
−No recomendado paraalojamiento propio · agentes exigentes
45.4índice de inteligencia$2.0entrada / 1M$6.0salida / 1M
presupuesto medio · especialista · verificado con datos externos
GLM-5.3 registra IQ 44.8 y entrada $1.4/M en las fuentes. Considéralo para alojamiento propio, entornos regulados; para agentes exigentes, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.
+Adecuado paraalojamiento propio · entornos regulados · procesamiento por lotes
−No recomendado paraagentes exigentes · programación de máxima dificultad
44.8índice de inteligencia$1.4entrada / 1M$4.4salida / 1M
modelo abierto / operación propia · especialista · verificado con datos externos
Para procesamiento por lotes, con datos verificados.
DeepSeek V4.1 Flash registra IQ 39.5 y entrada $0.3/M en las fuentes. Considéralo para procesamiento por lotes, respuestas rápidas; para razonamiento de máxima dificultad, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprocesamiento por lotes · respuestas rápidas · alojamiento propio
−No recomendado pararazonamiento de máxima dificultad · programación de máxima dificultad
39.5índice de inteligencia$0.3entrada / 1M$1.2salida / 1M
modelo abierto / operación propia · especialista · verificado con datos externos
especialistamodelo abierto / operación propiaprocesamiento por lotesrespuestas rápidas
Para procesamiento por lotes, con datos verificados.
Gemini 3.6 Flash registra IQ 34 y entrada $0.75/M en las fuentes. Considéralo para procesamiento por lotes, conocimiento de la empresa; para desarrollo complejo, plazos de respuesta estrictos, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprocesamiento por lotes · conocimiento de la empresa · respuestas rápidas
−No recomendado paradesarrollo complejo · plazos de respuesta estrictos
34.0índice de inteligencia$0.75entrada / 1M$3.75salida / 1M
bajo coste a gran escala · especialista · verificado con datos externos
especialistabajo coste a gran escalaprocesamiento por lotesconocimiento de la empresa
Para procesamiento por lotes, con datos verificados.
DeepSeek V4 Pro 0813 registra IQ 36 y entrada $1.32/M en las fuentes. Considéralo para procesamiento por lotes, programación; para controles y auditoría de empresa, agentes exigentes, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprocesamiento por lotes · programación · alojamiento propio
−No recomendado paracontroles y auditoría de empresa · agentes exigentes
36.0índice de inteligencia$1.32entrada / 1M$3.96salida / 1M
modelo abierto / operación propia · especialista · verificado con datos externos
especialistamodelo abierto / operación propiaprocesamiento por lotesprogramación
Para conocimiento de la empresa, con datos verificados.
Command A Plus registra IQ 13.1 y entrada $0/M en las fuentes. Considéralo para conocimiento de la empresa, extracción de documentos; para programación de máxima dificultad, razonamiento de máxima dificultad, realiza otra evaluación antes de desplegarlo.
+Adecuado paraconocimiento de la empresa · extracción de documentos · entornos regulados
−No recomendado paraprogramación de máxima dificultad · razonamiento de máxima dificultad
13.1índice de inteligencia$0.0entrada / 1M$0.0salida / 1M
bajo coste a gran escala · especialista · verificado con datos externos
especialistabajo coste a gran escalaconocimiento de la empresaextracción de documentos
Llama 4 Maverick registra IQ 10 y entrada $0.25/M en las fuentes. Considéralo para alojamiento propio, entornos regulados; para comodidad de una API gestionada, razonamiento de máxima dificultad, realiza otra evaluación antes de desplegarlo.
+Adecuado paraalojamiento propio · entornos regulados · conocimiento de la empresa
−No recomendado paracomodidad de una API gestionada · razonamiento de máxima dificultad
10.0índice de inteligencia$0.25entrada / 1M$0.87salida / 1M
modelo abierto / operación propia · especialista · verificado con datos externos
Kimi K3 registra IQ 43.6 y entrada $3/M en las fuentes. Considéralo para programación, procesamiento por lotes; para controles y auditoría de empresa, uso fiable de herramientas, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · procesamiento por lotes · conocimiento de la empresa
−No recomendado paracontroles y auditoría de empresa · uso fiable de herramientas
43.6índice de inteligencia$3.0entrada / 1M$15.0salida / 1M
presupuesto medio · especialista · verificado con datos externos
especialistapresupuesto medioprogramaciónprocesamiento por lotes
Claude Sonnet 5.5 registra IQ 40.8 y entrada $2/M en las fuentes. Considéralo para programación, agentes de IA; para alojamiento propio, procesamiento masivo de bajo coste, realiza otra evaluación antes de desplegarlo.
+Adecuado paraprogramación · agentes de IA · conocimiento de la empresa
−No recomendado paraalojamiento propio · procesamiento masivo de bajo coste
40.8índice de inteligencia$2.0entrada / 1M$10.0salida / 1M
presupuesto medio · especialista · verificado con datos externos
especialistapresupuesto medioprogramaciónagentes de IA
Para conocimiento de la empresa, con datos verificados.
Gemini 3.1 Pro Preview registra IQ 29.7 y entrada $2/M en las fuentes. Considéralo para conocimiento de la empresa, imágenes y contenido multimodal; para plazos de respuesta estrictos, alojamiento propio, realiza otra evaluación antes de desplegarlo.
+Adecuado paraconocimiento de la empresa · imágenes y contenido multimodal · contenido multilingüe
−No recomendado paraplazos de respuesta estrictos · alojamiento propio
29.7índice de inteligencia$2.0entrada / 1M$12.0salida / 1M
presupuesto medio · especialista · verificado con datos externos
especialistapresupuesto medioconocimiento de la empresaimágenes y contenido multimodal
Mistral Medium 3.5 registra IQ 14.2 y entrada $1.5/M en las fuentes. Considéralo para entornos regulados, conocimiento de la empresa; para razonamiento de máxima dificultad, programación de máxima dificultad, realiza otra evaluación antes de desplegarlo.
+Adecuado paraentornos regulados · conocimiento de la empresa · extracción de documentos
−No recomendado pararazonamiento de máxima dificultad · programación de máxima dificultad
14.2índice de inteligencia$1.5entrada / 1M$7.5salida / 1M
presupuesto medio · especialista · verificado con datos externos
especialistapresupuesto medioentornos reguladosconocimiento de la empresa
Selección de modelos actualizada a diario. Compruebo los precios y el Intelligence Index con datos recientes de Artificial Analysis; los demás benchmarks indican sus propias fuentes. Un cambio de metodología puede alterar la puntuación sin que cambie el modelo, por lo que los índices de distintas fechas no siempre son comparables. Si falla la validación, se conserva la última versión verificada con su fecha original.