Abbiamo sottoposto ogni grande modello linguistico allo stesso lavoro. Poi li abbiamo classificati.
Un insieme identico di compiti, 53 modelli, valutati su qualità, velocità, controllo e valore. API chiuse e pesi aperti sulla stessa pagina, perché è questa la scelta.
- Monitorati
- 53
- Recensiti in dettaglio
- 00
- Categorie
- 05
- Punteggio medio
- 79.1
La risposta breve
Qual è il miglior modello AI nel 2026?
Il nostro indice di 53 grandi modelli linguistici è guidato da Claude Fable 5 con 89.2 su 100, davanti a GPT-5.6 Sol con 88.6 e Claude Opus 5 con 88.5. I modelli sono valutati su qualità della risposta, latenza, guidabilità e capacità per dollaro, con la qualità della risposta che pesa di più. Niente qui è sponsorizzato.
Indice aggiornato il
L'indice dei modelli
Ogni grande modello linguistico che seguiamo, in ordine di classifica.
I modelli di punta, i pesi aperti che puoi ospitare tu stesso e i modelli leggeri abbastanza rapidi da girare in loop. Filtra per tipo di modello o riordina in base a ciò che ti interessa.
53 builder
0189.2Claude Fable 5
La risposta migliore che il denaro possa comprare, e costa parecchio.
FrontierProvvisorio
0288.6GPT-5.6 Sol
Il pensatore più profondo di OpenAI: quello a cui affidare un problema che non riesci a risolvere tu.
RagionamentoProvvisorio
0388.5Claude Opus 5
Quasi tutto il flagship, a metà prezzo. Quello a cui rivolgersi per default.
FrontierProvvisorio
0487.9Claude Sonnet 5
Il cavallo da lavoro per il codice: vicino al vertice sui task software reali, a un prezzo sostenibile.
CodiceProvvisorio
0587.5Kimi K3
Il più grande modello open weights mai pubblicato da chiunque, e legge un milione di token senza battere ciglio.
Pesi apertiProvvisorio
- GLM-5.20687.1
GLM-5.2
Output di classe frontier, licenza MIT e un milione di token di contesto. Questa combinazione è la notizia.
Pesi apertiProvvisorio
- DeepSeek V4 Pro0786.8
DeepSeek V4 Pro
Un modello di ragionamento alla frontiera, pubblicato sotto licenza MIT, prezzato come un ripensamento.
RagionamentoProvvisorio
- Gemini 3.6 Flash0886.6
Gemini 3.6 Flash
Risposte frontier alla velocità di Flash, con un piano gratuito su cui si può davvero costruire.
FrontierProvvisorio
- Grok 4.50985.0
Grok 4.5
Forte, attuale, e insolitamente disposto a rispondere alla domanda che hai davvero fatto.
FrontierProvvisorio
- MiniMax M31084.5
MiniMax M3
Pesi aperti ottimizzati per il lavoro software, e la decodifica più veloce di qualsiasi cosa nella sua classe.
CodiceProvvisorio
1184.4GPT-5.6 Terra
La fascia media di OpenAI, quella che la maggior parte dei team dovrebbe davvero distribuire.
FrontierProvvisorio
- Qwen 3.61283.3
Qwen 3.6
La release Qwen aperta che la maggior parte delle persone dovrebbe davvero far girare, in dimensioni che si adattano all'hardware reale.
Pesi apertiProvvisorio
1383.3GPT-5.6 Luna
I modi della famiglia frontier a un prezzo che ti permette di smettere di contare i token.
Piccolo e veloceProvvisorio
1482.9Mistral Large 3
La risposta europea, pubblicata sotto Apache 2.0, con un quarto di milione di token di contesto.
Pesi apertiProvvisorio
- DeepSeek V4 Flash1582.6
DeepSeek V4 Flash
Risposte vicine alla frontiera a circa un centesimo del prezzo frontier, con i pesi pubblicati.
Pesi apertiProvvisorio
L'indice completo
Tutte le voci di questa pagina, in ordine di classifica. Le schede sopra si caricano a blocchi, questo elenco no.
- 01Claude Fable 589.2
- 02GPT-5.6 Sol88.6
- 03Claude Opus 588.5
- 04Claude Sonnet 587.9
- 05Kimi K387.5
- 06GLM-5.287.1
- 07DeepSeek V4 Pro86.8
- 08Gemini 3.6 Flash86.6
- 09Grok 4.585.0
- 10MiniMax M384.5
- 11GPT-5.6 Terra84.4
- 12Qwen 3.683.3
- 13GPT-5.6 Luna83.3
- 14Mistral Large 382.9
- 15DeepSeek V4 Flash82.6
- 16Xiaomi MiMo V2.5 Pro82.4
- 17Qwen 3.5 397B81.9
- 18Step 3.7 Flash81.6
- 19Doubao Seed 2.0 Pro81.5
- 20Muse Spark81.3
- 21Qwen 3.8-Max81.2
- 22Qwen 3.7-Max81.0
- 23Llama 4 Maverick80.4
- 24Nemotron 3 Super80.1
- 25Gemma 480.1
- 26Hunyuan HY380.0
- 27Solar Open 279.2
- 28Claude Haiku 4.578.9
- 29Mistral Medium 3.578.6
- 30Llama 4 Behemoth78.2
- 31Mistral Small 478.1
- 32EXAONE 2.077.8
- 33ERNIE 5.177.7
- 34openPangu 2.0 Pro77.7
- 35Llama 4 Scout77.3
- 36Amazon Nova Premier77.3
- 37Hermes 477.0
- 38Grok 4.2076.9
- 39Cohere Command A+76.8
- 40Phi-4 Reasoning Vision76.8
- 41Gemini 3.5 Flash-Lite75.2
- 42Sarvam 105B74.3
- 43Mercury 273.2
- 44IBM Granite 3.272.5
- 45Amazon Nova Lite72.4
- 46OLMo 3.172.0
- 47Perplexity Sonar Pro71.6
- 48Doubao Seed 1.6 Flash71.2
- 49HyperCLOVA X THINK70.7
- 50Ministral 369.0
- 51Reka Edge68.7
- 52SmolLM367.7
- 53Liquid LFM 266.7
Aggiornamento settimanale
La classifica si muove. Scopri quando.
One short email a week: what changed in the index, which builder moved and why, and anything new worth trying. No sponsorships, no reprinted press releases.