Skip to content
Kembali ke indeks
46Bobot terbukaSkor sementara

OLMo 3.1

OLMo 3.1

Satu-satunya model di sini yang bisa Anda baca data pelatihannya sekaligus bobotnya.

Diperbarui

OLMo 3.1 preview

Ulasan

Ai2 menerbitkan segalanya: bobot, korpus pelatihan penuh, kode, dan checkpoint antara dari sepanjang proses pelatihan. Tidak ada model lain di indeks ini yang mendekati itu, dan untuk riset, audit, atau deployment apa pun yang harus menjawab "dilatih pada apa", tidak ada opsi nyata lainnya. Dari sisi kemampuan mentah ia tidak bersaing dengan model di sebelahnya, dan ia tidak berpura-pura melakukannya.

Di mana ia unggul

  • Benar-benar dapat direproduksi: data dan checkpoint diterbitkan, bukan sekadar bobot
  • Apache 2.0 sepenuhnya, tanpa kondisi downstream
  • Satu-satunya jawaban yang kredibel ketika asal-usul adalah persyaratan keras

Perlu diketahui terlebih dahulu

  • Jelas tertinggal dari bidang pada kemampuan umum
  • Jendela konteks pendek menurut standar saat ini

Skor indeks

72.0

Sementara. Skor ini dibaca dari kemampuan publik produk, bukan dari uji coba satu prompt yang dilalui entri yang telah ditinjau sepenuhnya, jadi anggaplah ini sebagai penempatan sementara, bukan keputusan final.

Craft56
Speed78
Control97
Value94
Ranking
46 dari 53
Membangun untuk
LLMs
Kategori
Bobot terbuka
Output
Bobot berlisensi Apache, data, kode, dan checkpoint
Harga
Tier gratis
Terbaik untuk
Riset dan deployment apa pun yang harus mengaudit data pelatihannya

Skor adalah penilaian editorial kami sendiri, dengan bobot kualitas 55, kecepatan 10, kontrol 15, dan nilai 20.