Skip to content

Seleção

Qual é o LLM capaz mais barato em 2026?

DeepSeek V4 Flash é a nossa escolha, com 82.6 de 100 em qualidade, velocidade, controle e custo-benefício, e Gemma 4 logo atrás com 80.1. Estes são os cinco melhores modelos com plano gratuito que continuam fortes em qualidade de resposta, escolhidos entre 19 que se qualificam e classificados pelo mesmo critério do resto do índice.

Índice atualizado em

Escolhidos entre 19 que se qualificam, de 53 rastreados

A seleção

  1. 01

    DeepSeek V4 Flash

    Respostas próximas ao frontier por cerca de um centésimo do preço frontier, com os pesos publicados.

    Pesos abertosPlano gratuito

    Ideal para

    Trabalho de alto volume onde a conta de tokens é o limitante

    82.6

  2. 02

    Gemma 4

    Os pesos abertos do Google, de algo que roda em um celular até um modelo de servidor real.

    Pesos abertosPlano gratuito

    Ideal para

    Rodar um modelo capaz em hardware que você controla

    80.1

  3. 03

    GLM-5.2

    Saída de nível frontier, licença MIT e um milhão de tokens de contexto. Essa combinação é a história.

    Pesos abertosPlano gratuito

    Ideal para

    Trabalho de nível frontier que você precisa manter internamente

    87.1

  4. 04

    MiniMax M3

    Pesos abertos ajustados para trabalho de software, e a decodificação mais rápida da sua categoria.

    CódigoPlano gratuito

    Ideal para

    Agentes de código que precisam de velocidade tanto quanto de precisão

    84.5

  5. 05

    Qwen 3.6

    O lançamento aberto do Qwen que a maioria das pessoas deveria realmente rodar, em tamanhos que cabem em hardware real.

    Pesos abertosPlano gratuito

    Ideal para

    Auto-hospedagem e fine-tuning no hardware que você já tem

    83.3