Kami memberikan pekerjaan yang sama kepada setiap large language model. Lalu kami meranking mereka.
Satu set tugas yang identik, 53 model, dinilai dari segi kualitas, kecepatan, kontrol, dan nilai. API tertutup dan open weights dalam satu halaman, karena itulah pilihan yang sebenarnya.
- Dipantau
- 53
- Ditinjau sepenuhnya
- 00
- Kategori
- 05
- Skor rata-rata
- 79.1
Jawaban singkatnya
Apa model AI terbaik di 2026?
Claude Fable 5 memimpin indeks kami yang berisi 53 large language model dengan skor 89.2 dari 100, unggul atas GPT-5.6 Sol dengan 88.6 dan Claude Opus 5 dengan 88.5. Model dinilai dari kualitas jawaban, latensi, kemudahan diarahkan, dan kapabilitas per dolar, dengan kualitas jawaban berbobot paling besar. Tidak ada yang disponsori di sini.
Indeks diperbarui
Indeks model
Setiap large language model yang kami pantau, dalam urutan ranking.
Model unggulan frontier, open weights yang bisa Anda hosting sendiri, dan model kecil yang cukup cepat untuk digunakan dalam loop. Saring berdasarkan jenis model, atau urutkan berdasarkan apa yang Anda pedulikan.
53 builder
0189.2Claude Fable 5
Jawaban terbaik yang bisa dibeli, dan harganya memang mahal.
FrontierSementara
0288.6GPT-5.6 Sol
Pemikir terdalam OpenAI: yang diberikan untuk masalah yang tidak bisa Anda selesaikan sendiri.
PenalaranSementara
0388.5Claude Opus 5
Sebagian besar kemampuan andalan, separuh harganya. Yang pertama kali dicapai secara default.
FrontierSementara
0487.9Claude Sonnet 5
Kuda kerja coding: mendekati teratas pada tugas perangkat lunak nyata, dengan harga yang layak pakai.
PemrogramanSementara
0587.5Kimi K3
Model open weights terbesar yang pernah diterbitkan siapa pun, dan membaca sejuta token tanpa terkesiap.
Bobot terbukaSementara
- GLM-5.20687.1
GLM-5.2
Output kelas frontier, lisensi MIT, dan sejuta token konteks. Kombinasi itulah ceritanya.
Bobot terbukaSementara
- DeepSeek V4 Pro0786.8
DeepSeek V4 Pro
Model penalaran di tingkat frontier, diterbitkan di bawah MIT, dihargai seperti hal sepele.
PenalaranSementara
- Gemini 3.6 Flash0886.6
Gemini 3.6 Flash
Jawaban frontier dengan kecepatan Flash, dengan tier gratis yang benar-benar bisa dibangun.
FrontierSementara
- Grok 4.50985.0
Grok 4.5
Kuat, terkini, dan tidak biasa dalam kesediaannya menjawab pertanyaan yang sebenarnya Anda tanyakan.
FrontierSementara
- MiniMax M31084.5
MiniMax M3
Open weights yang disetel untuk pekerjaan perangkat lunak, dan decoding tercepat dari apa pun di kelasnya.
PemrogramanSementara
1184.4GPT-5.6 Terra
Tengah rentang OpenAI, dan yang sebenarnya harus di-deploy sebagian besar tim.
FrontierSementara
- Qwen 3.61283.3
Qwen 3.6
Rilis Qwen open yang seharusnya dijalankan kebanyakan orang, dalam ukuran yang cocok dengan perangkat keras nyata.
Bobot terbukaSementara
1383.3GPT-5.6 Luna
Tata krama keluarga frontier dengan harga yang membuat Anda berhenti menghitung token.
Kecil dan cepatSementara
1482.9Mistral Large 3
Jawaban Eropa, diterbitkan di bawah Apache 2.0, dengan seperempat juta token konteks.
Bobot terbukaSementara
- DeepSeek V4 Flash1582.6
DeepSeek V4 Flash
Jawaban mendekati frontier pada sekitar sepersertaus harga frontier, dengan bobot yang dipublikasikan.
Bobot terbukaSementara
Indeks lengkap
Semua entri di halaman ini, urut peringkat. Kartu di atas dimuat bertahap; daftar ini tidak.
- 01Claude Fable 589.2
- 02GPT-5.6 Sol88.6
- 03Claude Opus 588.5
- 04Claude Sonnet 587.9
- 05Kimi K387.5
- 06GLM-5.287.1
- 07DeepSeek V4 Pro86.8
- 08Gemini 3.6 Flash86.6
- 09Grok 4.585.0
- 10MiniMax M384.5
- 11GPT-5.6 Terra84.4
- 12Qwen 3.683.3
- 13GPT-5.6 Luna83.3
- 14Mistral Large 382.9
- 15DeepSeek V4 Flash82.6
- 16Xiaomi MiMo V2.5 Pro82.4
- 17Qwen 3.5 397B81.9
- 18Step 3.7 Flash81.6
- 19Doubao Seed 2.0 Pro81.5
- 20Muse Spark81.3
- 21Qwen 3.8-Max81.2
- 22Qwen 3.7-Max81.0
- 23Llama 4 Maverick80.4
- 24Nemotron 3 Super80.1
- 25Gemma 480.1
- 26Hunyuan HY380.0
- 27Solar Open 279.2
- 28Claude Haiku 4.578.9
- 29Mistral Medium 3.578.6
- 30Llama 4 Behemoth78.2
- 31Mistral Small 478.1
- 32EXAONE 2.077.8
- 33ERNIE 5.177.7
- 34openPangu 2.0 Pro77.7
- 35Llama 4 Scout77.3
- 36Amazon Nova Premier77.3
- 37Hermes 477.0
- 38Grok 4.2076.9
- 39Cohere Command A+76.8
- 40Phi-4 Reasoning Vision76.8
- 41Gemini 3.5 Flash-Lite75.2
- 42Sarvam 105B74.3
- 43Mercury 273.2
- 44IBM Granite 3.272.5
- 45Amazon Nova Lite72.4
- 46OLMo 3.172.0
- 47Perplexity Sonar Pro71.6
- 48Doubao Seed 1.6 Flash71.2
- 49HyperCLOVA X THINK70.7
- 50Ministral 369.0
- 51Reka Edge68.7
- 52SmolLM367.7
- 53Liquid LFM 266.7
Update mingguan
Ranking bergerak. Ketahui kapan.
One short email a week: what changed in the index, which builder moved and why, and anything new worth trying. No sponsorships, no reprinted press releases.