Skip to content
Kembali ke indeks
01FrontierSkor sementara

Claude Fable 5

Claude Fable 5

Jawaban terbaik yang bisa dibeli, dan harganya memang mahal.

Diperbarui

Claude Fable 5 preview

Ulasan

Andalan Anthropic bertengger di puncak hampir setiap benchmark kualitas yang masih membedakan model frontier, dan satu-satunya yang dipercaya orang untuk berjalan berjam-jam tanpa manusia membaca setiap langkahnya. Ini juga model paling mahal di indeks ini dengan selisih yang jelas, dan tidak cepat. Gunakan ketika biaya jawaban yang salah lebih tinggi dari biaya token, dan pilih yang lain jika tidak.

Di mana ia unggul

  • Mempertahankan tugas panjang yang berantakan selama berjam-jam tanpa menyimpang
  • Memimpin bidang pada benchmark rekayasa perangkat lunak yang belum jenuh
  • Menolak dengan jelas dan menjelaskan dirinya sendiri, bukan mengarang jawaban

Perlu diketahui terlebih dahulu

  • Sejauh ini harga per token tertinggi dari semua yang ada di sini
  • Cukup lambat sehingga bukan pilihan default untuk pekerjaan interaktif

Skor indeks

89.2

Sementara. Skor ini dibaca dari kemampuan publik produk, bukan dari uji coba satu prompt yang dilalui entri yang telah ditinjau sepenuhnya, jadi anggaplah ini sebagai penempatan sementara, bukan keputusan final.

Craft98
Speed76
Control91
Value70
Ranking
01 dari 53
Membangun untuk
LLMs
Kategori
Frontier
Output
Teks, kode, dan pemanggilan alat melalui API
Harga
Berbayar saja
Terbaik untuk
Pekerjaan otonom panjang di mana kesalahan itu mahal harganya

Skor adalah penilaian editorial kami sendiri, dengan bobot kualitas 55, kecepatan 10, kontrol 15, dan nilai 20.