Seleção
Qual é o LLM capaz mais barato em 2026?
DeepSeek V4 Flash é a nossa escolha, com 82.6 de 100 em qualidade, velocidade, controle e custo-benefício, e Gemma 4 logo atrás com 80.1. Estes são os cinco melhores modelos com plano gratuito que continuam fortes em qualidade de resposta, escolhidos entre 19 que se qualificam e classificados pelo mesmo critério do resto do índice.
Índice atualizado em
Escolhidos entre 19 que se qualificam, de 53 rastreados
A seleção
- 01
DeepSeek V4 Flash
Respostas próximas ao frontier por cerca de um centésimo do preço frontier, com os pesos publicados.
Pesos abertosPlano gratuitoIdeal para
Trabalho de alto volume onde a conta de tokens é o limitante
- 02
Gemma 4
Os pesos abertos do Google, de algo que roda em um celular até um modelo de servidor real.
Pesos abertosPlano gratuitoIdeal para
Rodar um modelo capaz em hardware que você controla
- 03
GLM-5.2
Saída de nível frontier, licença MIT e um milhão de tokens de contexto. Essa combinação é a história.
Pesos abertosPlano gratuitoIdeal para
Trabalho de nível frontier que você precisa manter internamente
- 04
MiniMax M3
Pesos abertos ajustados para trabalho de software, e a decodificação mais rápida da sua categoria.
CódigoPlano gratuitoIdeal para
Agentes de código que precisam de velocidade tanto quanto de precisão
- 05
Qwen 3.6
O lançamento aberto do Qwen que a maioria das pessoas deveria realmente rodar, em tamanhos que cabem em hardware real.
Pesos abertosPlano gratuitoIdeal para
Auto-hospedagem e fine-tuning no hardware que você já tem