Nous avons soumis chaque grand modèle de langage au même travail. Puis nous les avons classés.
Un ensemble de tâches identique, 53 modèles, notés sur le soin, la vitesse, le contrôle et le rapport qualité-prix. API fermées et poids ouverts sur la même page, car c'est bien là le choix.
- Référencés
- 53
- Entièrement évalués
- 00
- Catégories
- 05
- Note moyenne
- 79.1
La réponse courte
Quel est le meilleur modèle IA en 2026 ?
Claude Fable 5 est en tête de notre index de 53 grands modèles de langage avec 89.2 sur 100, devant GPT-5.6 Sol à 88.6 et Claude Opus 5 à 88.5. Les modèles sont notés sur la qualité de la réponse, la latence, la dirigeabilité et la capacité par dollar, la qualité de la réponse pesant le plus lourd. Rien ici n'est sponsorisé.
Index mis à jour le
L'index des modèles
Tous les grands modèles de langage suivis, par ordre de classement.
Les modèles phares de la frontière, les poids ouverts que vous pouvez héberger vous-même et les petits modèles assez rapides pour tourner en boucle. Filtrez par type de modèle ou reclassez selon vos priorités.
53 constructeurs
0189.2Claude Fable 5
La meilleure réponse que l'argent puisse acheter, et ça coûte cher.
FrontièreProvisoire
0288.6GPT-5.6 Sol
Le penseur le plus profond d'OpenAI : celui à qui confier un problème que vous ne savez pas résoudre vous-même.
RaisonnementProvisoire
0388.5Claude Opus 5
L'essentiel du modèle phare, à moitié prix. Celui vers lequel se tourner par défaut.
FrontièreProvisoire
0487.9Claude Sonnet 5
Le cheval de travail du développement : proche du sommet sur les vraies tâches logicielles, à un prix praticable.
DéveloppementProvisoire
0587.5Kimi K3
Le plus grand modèle à poids ouverts que quiconque ait publié, et il lit un million de tokens sans ciller.
Poids ouvertsProvisoire
- GLM-5.20687.1
GLM-5.2
Une sortie de niveau frontier, une licence MIT et un million de tokens de contexte. Cette combinaison est le sujet.
Poids ouvertsProvisoire
- DeepSeek V4 Pro0786.8
DeepSeek V4 Pro
Un modèle de raisonnement au niveau frontier, publié sous MIT, tarifé comme une réflexion après coup.
RaisonnementProvisoire
- Gemini 3.6 Flash0886.6
Gemini 3.6 Flash
Des réponses frontier à la vitesse Flash, avec une offre gratuite sur laquelle on peut vraiment construire.
FrontièreProvisoire
- Grok 4.50985.0
Grok 4.5
Solide, actuel, et inhabituellement prêt à répondre à la question que vous avez réellement posée.
FrontièreProvisoire
- MiniMax M31084.5
MiniMax M3
Poids ouverts affinés pour le travail logiciel, avec le décodage le plus rapide de tout ce qui est dans sa catégorie.
DéveloppementProvisoire
1184.4GPT-5.6 Terra
Le milieu de gamme d'OpenAI, et celui que la plupart des équipes devraient réellement déployer.
FrontièreProvisoire
- Qwen 3.61283.3
Qwen 3.6
La version ouverte de Qwen que la plupart des gens devraient réellement faire tourner, dans des tailles qui s'adaptent au vrai matériel.
Poids ouvertsProvisoire
1383.3GPT-5.6 Luna
Les bonnes manières de la famille frontier à un prix qui vous permet d'arrêter de compter les tokens.
Petit et rapideProvisoire
1482.9Mistral Large 3
La réponse européenne, publiée sous Apache 2.0, avec un quart de million de tokens de contexte.
Poids ouvertsProvisoire
- DeepSeek V4 Flash1582.6
DeepSeek V4 Flash
Des réponses proches du frontier à environ un centième du prix frontier, avec les poids publiés.
Poids ouvertsProvisoire
L'index complet
Toutes les entrées de cette page, par ordre de classement. Les cartes ci-dessus se chargent par lots, pas cette liste.
- 01Claude Fable 589.2
- 02GPT-5.6 Sol88.6
- 03Claude Opus 588.5
- 04Claude Sonnet 587.9
- 05Kimi K387.5
- 06GLM-5.287.1
- 07DeepSeek V4 Pro86.8
- 08Gemini 3.6 Flash86.6
- 09Grok 4.585.0
- 10MiniMax M384.5
- 11GPT-5.6 Terra84.4
- 12Qwen 3.683.3
- 13GPT-5.6 Luna83.3
- 14Mistral Large 382.9
- 15DeepSeek V4 Flash82.6
- 16Xiaomi MiMo V2.5 Pro82.4
- 17Qwen 3.5 397B81.9
- 18Step 3.7 Flash81.6
- 19Doubao Seed 2.0 Pro81.5
- 20Muse Spark81.3
- 21Qwen 3.8-Max81.2
- 22Qwen 3.7-Max81.0
- 23Llama 4 Maverick80.4
- 24Nemotron 3 Super80.1
- 25Gemma 480.1
- 26Hunyuan HY380.0
- 27Solar Open 279.2
- 28Claude Haiku 4.578.9
- 29Mistral Medium 3.578.6
- 30Llama 4 Behemoth78.2
- 31Mistral Small 478.1
- 32EXAONE 2.077.8
- 33ERNIE 5.177.7
- 34openPangu 2.0 Pro77.7
- 35Llama 4 Scout77.3
- 36Amazon Nova Premier77.3
- 37Hermes 477.0
- 38Grok 4.2076.9
- 39Cohere Command A+76.8
- 40Phi-4 Reasoning Vision76.8
- 41Gemini 3.5 Flash-Lite75.2
- 42Sarvam 105B74.3
- 43Mercury 273.2
- 44IBM Granite 3.272.5
- 45Amazon Nova Lite72.4
- 46OLMo 3.172.0
- 47Perplexity Sonar Pro71.6
- 48Doubao Seed 1.6 Flash71.2
- 49HyperCLOVA X THINK70.7
- 50Ministral 369.0
- 51Reka Edge68.7
- 52SmolLM367.7
- 53Liquid LFM 266.7
Mise à jour hebdomadaire
Le classement bouge. Sachez quand.
One short email a week: what changed in the index, which builder moved and why, and anything new worth trying. No sponsorships, no reprinted press releases.