Sometimos a todos los grandes modelos de lenguaje al mismo trabajo. Luego los clasificamos.
Un conjunto de tareas idéntico, 53 modelos, evaluados en calidad, velocidad, control y valor. APIs cerradas y pesos abiertos en la misma página, porque esa es la elección real.
- Registrados
- 53
- Revisados en profundidad
- 00
- Categorías
- 05
- Puntuación media
- 79.1
La respuesta breve
¿Cuál es el mejor modelo de IA en 2026?
Claude Fable 5 lidera nuestro índice de 53 grandes modelos de lenguaje con 89.2 sobre 100, por delante de GPT-5.6 Sol con 88.6 y Claude Opus 5 con 88.5. Los modelos se evalúan por la calidad de la respuesta, la latencia, la dirigibilidad y la capacidad por dólar, y la calidad de la respuesta es la que más pesa. Nada de esto está patrocinado.
Índice actualizado el
El índice de modelos
Todos los grandes modelos de lenguaje que seguimos, por orden de clasificación.
Modelos insignia de frontera, pesos abiertos que puedes alojar tú mismo y modelos pequeños lo bastante rápidos para usarse en un bucle. Filtra por tipo de modelo o reordena según lo que más te importa.
53 constructores
0189.2Claude Fable 5
La mejor respuesta que el dinero puede comprar, y cuesta mucho dinero.
FronteraProvisional
0288.6GPT-5.6 Sol
El pensador más profundo de OpenAI: al que recurrir ante un problema que no puedes resolver tú mismo.
RazonamientoProvisional
0388.5Claude Opus 5
Casi todo el modelo insignia, a mitad de precio. El que hay que elegir por defecto.
FronteraProvisional
0487.9Claude Sonnet 5
El caballo de batalla del código: cerca de la cima en tareas reales de software, a un precio viable.
ProgramaciónProvisional
0587.5Kimi K3
El mayor modelo de pesos abiertos que nadie ha publicado, y lee un millón de tokens sin inmutarse.
Pesos abiertosProvisional
- GLM-5.20687.1
GLM-5.2
Salida de clase frontera, licencia MIT y un millón de tokens de contexto. Esa combinación es la historia.
Pesos abiertosProvisional
- DeepSeek V4 Pro0786.8
DeepSeek V4 Pro
Un modelo de razonamiento en la frontera, publicado bajo MIT, con un precio como si fuera un detalle.
RazonamientoProvisional
- Gemini 3.6 Flash0886.6
Gemini 3.6 Flash
Respuestas de frontera a velocidad Flash, con un nivel gratuito sobre el que realmente se puede construir.
FronteraProvisional
- Grok 4.50985.0
Grok 4.5
Sólido, actual, y con una disposición inusualmente directa a responder la pregunta que realmente hiciste.
FronteraProvisional
- MiniMax M31084.5
MiniMax M3
Pesos abiertos ajustados para trabajo de software, y la decodificación más rápida de todo lo que hay en su clase.
ProgramaciónProvisional
1184.4GPT-5.6 Terra
El rango medio de OpenAI, y el que la mayoría de los equipos debería desplegar realmente.
FronteraProvisional
- Qwen 3.61283.3
Qwen 3.6
El lanzamiento de Qwen abierto que la mayoría debería ejecutar realmente, en tamaños que caben en hardware real.
Pesos abiertosProvisional
1383.3GPT-5.6 Luna
Los modales de la familia frontier a un precio que te permite dejar de contar tokens.
Pequeño y rápidoProvisional
1482.9Mistral Large 3
La respuesta europea, publicada bajo Apache 2.0, con un cuarto de millón de tokens de contexto.
Pesos abiertosProvisional
- DeepSeek V4 Flash1582.6
DeepSeek V4 Flash
Respuestas cercanas a la frontera a aproximadamente una centésima parte del precio de la frontera, con los pesos publicados.
Pesos abiertosProvisional
El índice completo
Todas las entradas de esta página, por orden de clasificación. Las tarjetas de arriba se cargan por tandas; esta lista no.
- 01Claude Fable 589.2
- 02GPT-5.6 Sol88.6
- 03Claude Opus 588.5
- 04Claude Sonnet 587.9
- 05Kimi K387.5
- 06GLM-5.287.1
- 07DeepSeek V4 Pro86.8
- 08Gemini 3.6 Flash86.6
- 09Grok 4.585.0
- 10MiniMax M384.5
- 11GPT-5.6 Terra84.4
- 12Qwen 3.683.3
- 13GPT-5.6 Luna83.3
- 14Mistral Large 382.9
- 15DeepSeek V4 Flash82.6
- 16Xiaomi MiMo V2.5 Pro82.4
- 17Qwen 3.5 397B81.9
- 18Step 3.7 Flash81.6
- 19Doubao Seed 2.0 Pro81.5
- 20Muse Spark81.3
- 21Qwen 3.8-Max81.2
- 22Qwen 3.7-Max81.0
- 23Llama 4 Maverick80.4
- 24Nemotron 3 Super80.1
- 25Gemma 480.1
- 26Hunyuan HY380.0
- 27Solar Open 279.2
- 28Claude Haiku 4.578.9
- 29Mistral Medium 3.578.6
- 30Llama 4 Behemoth78.2
- 31Mistral Small 478.1
- 32EXAONE 2.077.8
- 33ERNIE 5.177.7
- 34openPangu 2.0 Pro77.7
- 35Llama 4 Scout77.3
- 36Amazon Nova Premier77.3
- 37Hermes 477.0
- 38Grok 4.2076.9
- 39Cohere Command A+76.8
- 40Phi-4 Reasoning Vision76.8
- 41Gemini 3.5 Flash-Lite75.2
- 42Sarvam 105B74.3
- 43Mercury 273.2
- 44IBM Granite 3.272.5
- 45Amazon Nova Lite72.4
- 46OLMo 3.172.0
- 47Perplexity Sonar Pro71.6
- 48Doubao Seed 1.6 Flash71.2
- 49HyperCLOVA X THINK70.7
- 50Ministral 369.0
- 51Reka Edge68.7
- 52SmolLM367.7
- 53Liquid LFM 266.7
Actualización semanal
La clasificación cambia. Entérate cuándo.
One short email a week: what changed in the index, which builder moved and why, and anything new worth trying. No sponsorships, no reprinted press releases.