Wir haben jedem großen Sprachmodell dieselbe Aufgabe gestellt. Dann haben wir sie sortiert.
Ein identischer Aufgabensatz, 53 Modelle, bewertet nach Handwerk, Tempo, Kontrolle und Preis-Leistung. Geschlossene APIs und Open-Weights-Modelle auf einer Seite — denn das ist die eigentliche Entscheidung.
- Erfasst
- 53
- Vollständig geprüft
- 00
- Kategorien
- 05
- Durchschnittspunktzahl
- 79.1
Die kurze Antwort
Was ist das beste KI-Modell 2026?
Claude Fable 5 führt unseren Index aus 53 großen Sprachmodellen mit 89.2 von 100 Punkten an, vor GPT-5.6 Sol mit 88.6 und Claude Opus 5 mit 88.5. Modelle werden nach Antwortqualität, Latenz, Steuerbarkeit und Leistung pro Dollar bewertet, wobei die Antwortqualität am stärksten gewichtet wird. Nichts hier ist gesponsert.
Index aktualisiert am
Der Modell-Index
Jedes große Sprachmodell, das wir verfolgen, in der Rangfolge.
Frontier-Flaggschiffe, Open-Weights-Modelle zum Selbsthosten und kleine Modelle, die schnell genug für den Einsatz in Schleifen sind. Filtern Sie nach Modelltyp oder sortieren Sie nach dem, was Ihnen wichtig ist.
53 Baukästen
0189.2Claude Fable 5
Die beste Antwort, die Geld kaufen kann — und es ist viel Geld.
FrontierVorläufig
0288.6GPT-5.6 Sol
OpenAIs tiefster Denker: das Modell, dem man ein Problem übergibt, das man selbst nicht lösen kann.
ReasoningVorläufig
0388.5Claude Opus 5
Das meiste vom Flaggschiff zum halben Preis. Das Modell, nach dem man als Standard greift.
FrontierVorläufig
0487.9Claude Sonnet 5
Das Coding-Arbeitstier: nahe der Spitze bei echten Software-Aufgaben, zu einem realistischen Preis.
CodingVorläufig
0587.5Kimi K3
Das größte Open-Weights-Modell, das je jemand veröffentlicht hat — und es liest eine Million Token ohne mit der Wimper zu zucken.
Open WeightsVorläufig
- GLM-5.20687.1
GLM-5.2
Frontier-Ausgabequalität, eine MIT-Lizenz und eine Million Token Kontext. Diese Kombination ist die Geschichte.
Open WeightsVorläufig
- DeepSeek V4 Pro0786.8
DeepSeek V4 Pro
Ein Reasoning-Modell an der Frontier, unter MIT veröffentlicht, zu einem Preis wie ein Nachgedanke.
ReasoningVorläufig
- Gemini 3.6 Flash0886.6
Gemini 3.6 Flash
Frontier-Antworten mit Flash-Geschwindigkeit und einem kostenlosen Tarif, auf dem man wirklich aufbauen kann.
FrontierVorläufig
- Grok 4.50985.0
Grok 4.5
Stark, aktuell und ungewöhnlich bereit, die Frage zu beantworten, die man wirklich gestellt hat.
FrontierVorläufig
- MiniMax M31084.5
MiniMax M3
Open Weights für Software-Arbeit optimiert, mit der schnellsten Dekodierung seiner Klasse.
CodingVorläufig
1184.4GPT-5.6 Terra
Die Mitte von OpenAIs Palette — und das Modell, das die meisten Teams tatsächlich einsetzen sollten.
FrontierVorläufig
- Qwen 3.61283.3
Qwen 3.6
Das offene Qwen-Release, das die meisten Menschen tatsächlich einsetzen sollten, in Größen für echte Hardware.
Open WeightsVorläufig
1383.3GPT-5.6 Luna
Die Umgangsformen der Frontier-Familie zu einem Preis, der das Token-Zählen überflüssig macht.
Klein und schnellVorläufig
1482.9Mistral Large 3
Europas Antwort, unter Apache 2.0 veröffentlicht, mit einer Viertelmillion Token Kontext.
Open WeightsVorläufig
- DeepSeek V4 Flash1582.6
DeepSeek V4 Flash
Nahezu Frontier-Antworten zu etwa einem Hundertstel der Frontier-Preise, mit veröffentlichten Gewichten.
Open WeightsVorläufig
Der vollständige Index
Jeder Eintrag dieser Seite, nach Rang sortiert. Die Karten oben laden in Etappen, diese Liste nicht.
- 01Claude Fable 589.2
- 02GPT-5.6 Sol88.6
- 03Claude Opus 588.5
- 04Claude Sonnet 587.9
- 05Kimi K387.5
- 06GLM-5.287.1
- 07DeepSeek V4 Pro86.8
- 08Gemini 3.6 Flash86.6
- 09Grok 4.585.0
- 10MiniMax M384.5
- 11GPT-5.6 Terra84.4
- 12Qwen 3.683.3
- 13GPT-5.6 Luna83.3
- 14Mistral Large 382.9
- 15DeepSeek V4 Flash82.6
- 16Xiaomi MiMo V2.5 Pro82.4
- 17Qwen 3.5 397B81.9
- 18Step 3.7 Flash81.6
- 19Doubao Seed 2.0 Pro81.5
- 20Muse Spark81.3
- 21Qwen 3.8-Max81.2
- 22Qwen 3.7-Max81.0
- 23Llama 4 Maverick80.4
- 24Nemotron 3 Super80.1
- 25Gemma 480.1
- 26Hunyuan HY380.0
- 27Solar Open 279.2
- 28Claude Haiku 4.578.9
- 29Mistral Medium 3.578.6
- 30Llama 4 Behemoth78.2
- 31Mistral Small 478.1
- 32EXAONE 2.077.8
- 33ERNIE 5.177.7
- 34openPangu 2.0 Pro77.7
- 35Llama 4 Scout77.3
- 36Amazon Nova Premier77.3
- 37Hermes 477.0
- 38Grok 4.2076.9
- 39Cohere Command A+76.8
- 40Phi-4 Reasoning Vision76.8
- 41Gemini 3.5 Flash-Lite75.2
- 42Sarvam 105B74.3
- 43Mercury 273.2
- 44IBM Granite 3.272.5
- 45Amazon Nova Lite72.4
- 46OLMo 3.172.0
- 47Perplexity Sonar Pro71.6
- 48Doubao Seed 1.6 Flash71.2
- 49HyperCLOVA X THINK70.7
- 50Ministral 369.0
- 51Reka Edge68.7
- 52SmolLM367.7
- 53Liquid LFM 266.7
Wöchentliches Update
Die Rangfolge bewegt sich. Erfahren Sie wann.
One short email a week: what changed in the index, which builder moved and why, and anything new worth trying. No sponsorships, no reprinted press releases.