Skip to content
सूचकांक पर वापस
46ओपन वेट्सअनंतिम स्कोर

OLMo 3.1

OLMo 3.1

यहाँ एकमात्र मॉडल जहाँ आप वेट्स के साथ-साथ training data भी पढ़ सकते हैं।

को अद्यतन

OLMo 3.1 preview

समीक्षा

Ai2 सब कुछ प्रकाशित करता है: वेट्स, पूरा training corpus, कोड, और run के दौरान के intermediate checkpoints। इस सूचकांक का कोई अन्य मॉडल इसके क़रीब नहीं आता, और शोध, ऑडिटिंग, या किसी भी deployment के लिए जिसे "इसे किस पर प्रशिक्षित किया गया" का जवाब देना हो, कोई अन्य विकल्प नहीं है। कच्ची क्षमता में यह उन मॉडलों से मुकाबला नहीं करता जिनके बगल में बैठता है, और यह दिखावा भी नहीं करता।

जहाँ यह श्रेष्ठ है

  • वास्तव में reproducible: data और checkpoints प्रकाशित, सिर्फ़ वेट्स नहीं
  • पूरी तरह Apache 2.0, बिना downstream conditions के
  • जब provenance एक कठिन आवश्यकता हो तो एकमात्र विश्वसनीय जवाब

पहले जानने योग्य

  • सामान्य क्षमता पर क्षेत्र से स्पष्ट रूप से पीछे
  • मौजूदा मानकों से छोटा context window

सूचकांक स्कोर

72.0

अनंतिम। यह स्कोर उत्पाद की सार्वजनिक क्षमता के आधार पर है, उस एकल-प्रॉम्प्ट पुनर्निर्माण से नहीं जिससे पूर्णतः समीक्षित प्रविष्टियाँ गुज़री हैं, इसलिए इसे किसी निर्णय की बजाय एक अनुमानित स्थान मानें।

Craft56
Speed78
Control97
Value94
क्रम
53 में से 46
निर्माण करता है
LLM
श्रेणी
ओपन वेट्स
परिणाम
Apache-लाइसेंस प्राप्त वेट्स, data, code और checkpoints
मूल्य-निर्धारण
निःशुल्क स्तर
सबसे उपयुक्त
शोध और कोई भी deployment जिसे training data ऑडिट करना हो

स्कोर हमारा अपना संपादकीय निर्णय हैं, जिनमें शिल्प का भार 55, गति का 10, नियंत्रण का 15 और मूल्य का 20 है।