Aplicamos o mesmo trabalho a todos os grandes modelos de linguagem. Depois os classificamos.
Um conjunto idêntico de tarefas, 53 modelos, avaliados em qualidade, velocidade, controle e custo-benefício. APIs fechadas e pesos abertos na mesma página, porque essa é a escolha.
- Rastreados
- 53
- Totalmente avaliados
- 00
- Categorias
- 05
- Pontuação média
- 79.1
A resposta curta
Qual é o melhor modelo de IA em 2026?
Claude Fable 5 lidera nosso índice de 53 grandes modelos de linguagem com 89.2 de 100, à frente de GPT-5.6 Sol com 88.6 e de Claude Opus 5 com 88.5. Os modelos são avaliados pela qualidade da resposta, latência, dirigibilidade e capacidade por dólar, com a qualidade da resposta tendo o maior peso. Nada aqui é patrocinado.
Índice atualizado em
O índice de modelos
Todos os grandes modelos de linguagem que acompanhamos, em ordem de classificação.
Modelos de ponta, pesos abertos que você pode hospedar por conta própria e modelos pequenos rápidos o suficiente para rodar em loop. Filtre pelo tipo de modelo ou reordene pelo critério que importa.
53 criadores
0189.2Claude Fable 5
A melhor resposta que o dinheiro pode comprar, e custa muito dinheiro.
FrontierProvisório
0288.6GPT-5.6 Sol
O pensador mais profundo da OpenAI: aquele para entregar um problema que você mesmo não consegue resolver.
RaciocínioProvisório
0388.5Claude Opus 5
Quase o carro-chefe, pela metade do preço. A escolha honesta como padrão.
FrontierProvisório
0487.9Claude Sonnet 5
O cavalo de batalha para código: perto do topo nas tarefas reais de software, a um preço viável.
CódigoProvisório
0587.5Kimi K3
O maior modelo de pesos abertos já lançado, e ele lê um milhão de tokens sem piscar.
Pesos abertosProvisório
- GLM-5.20687.1
GLM-5.2
Saída de nível frontier, licença MIT e um milhão de tokens de contexto. Essa combinação é a história.
Pesos abertosProvisório
- DeepSeek V4 Pro0786.8
DeepSeek V4 Pro
Um modelo de raciocínio no frontier, publicado sob MIT, precificado como se fosse uma ocorrência trivial.
RaciocínioProvisório
- Gemini 3.6 Flash0886.6
Gemini 3.6 Flash
Respostas frontier na velocidade Flash, com um plano gratuito para construir de verdade.
FrontierProvisório
- Grok 4.50985.0
Grok 4.5
Forte, atual, e inusualmente disposto a responder a pergunta que você realmente fez.
FrontierProvisório
- MiniMax M31084.5
MiniMax M3
Pesos abertos ajustados para trabalho de software, e a decodificação mais rápida da sua categoria.
CódigoProvisório
1184.4GPT-5.6 Terra
O meio da linha da OpenAI, e o que a maioria das equipes deveria realmente implantar.
FrontierProvisório
- Qwen 3.61283.3
Qwen 3.6
O lançamento aberto do Qwen que a maioria das pessoas deveria realmente rodar, em tamanhos que cabem em hardware real.
Pesos abertosProvisório
1383.3GPT-5.6 Luna
Os modos da família frontier a um preço que deixa você parar de contar tokens.
Pequeno e rápidoProvisório
1482.9Mistral Large 3
A resposta europeia, publicada sob Apache 2.0, com um quarto de milhão de tokens de contexto.
Pesos abertosProvisório
- DeepSeek V4 Flash1582.6
DeepSeek V4 Flash
Respostas próximas ao frontier por cerca de um centésimo do preço frontier, com os pesos publicados.
Pesos abertosProvisório
O índice completo
Todas as entradas desta página, em ordem de classificação. Os cards acima carregam em lotes; esta lista não.
- 01Claude Fable 589.2
- 02GPT-5.6 Sol88.6
- 03Claude Opus 588.5
- 04Claude Sonnet 587.9
- 05Kimi K387.5
- 06GLM-5.287.1
- 07DeepSeek V4 Pro86.8
- 08Gemini 3.6 Flash86.6
- 09Grok 4.585.0
- 10MiniMax M384.5
- 11GPT-5.6 Terra84.4
- 12Qwen 3.683.3
- 13GPT-5.6 Luna83.3
- 14Mistral Large 382.9
- 15DeepSeek V4 Flash82.6
- 16Xiaomi MiMo V2.5 Pro82.4
- 17Qwen 3.5 397B81.9
- 18Step 3.7 Flash81.6
- 19Doubao Seed 2.0 Pro81.5
- 20Muse Spark81.3
- 21Qwen 3.8-Max81.2
- 22Qwen 3.7-Max81.0
- 23Llama 4 Maverick80.4
- 24Nemotron 3 Super80.1
- 25Gemma 480.1
- 26Hunyuan HY380.0
- 27Solar Open 279.2
- 28Claude Haiku 4.578.9
- 29Mistral Medium 3.578.6
- 30Llama 4 Behemoth78.2
- 31Mistral Small 478.1
- 32EXAONE 2.077.8
- 33ERNIE 5.177.7
- 34openPangu 2.0 Pro77.7
- 35Llama 4 Scout77.3
- 36Amazon Nova Premier77.3
- 37Hermes 477.0
- 38Grok 4.2076.9
- 39Cohere Command A+76.8
- 40Phi-4 Reasoning Vision76.8
- 41Gemini 3.5 Flash-Lite75.2
- 42Sarvam 105B74.3
- 43Mercury 273.2
- 44IBM Granite 3.272.5
- 45Amazon Nova Lite72.4
- 46OLMo 3.172.0
- 47Perplexity Sonar Pro71.6
- 48Doubao Seed 1.6 Flash71.2
- 49HyperCLOVA X THINK70.7
- 50Ministral 369.0
- 51Reka Edge68.7
- 52SmolLM367.7
- 53Liquid LFM 266.7
Atualização semanal
O ranking muda. Saiba quando.
One short email a week: what changed in the index, which builder moved and why, and anything new worth trying. No sponsorships, no reprinted press releases.