กลับไปยังดัชนี
37Open weightsคะแนนเบื้องต้น
Hermes 4
Hermes 4
open model ขนาดใหญ่ที่ปรับแต่งมาให้ตอบไม่ใช่สอนเรื่องคำถาม
อัปเดต
Hermes 4
การวิเคราะห์
Nous ปรับแต่ง open base models ให้เป็น assistant ที่ควบคุมได้และปฏิเสธน้อย และ Hermes 4 คือ flagship ของงานนั้น มันทำตาม system prompt ได้ไกลกว่า commercial model ใด ๆ ซึ่งสำคัญสำหรับงานวิจัย การทดสอบ roleplay และทุก domain ที่ชั้นความปลอดภัยของแล็บใหญ่กีดขวางงานที่ถูกกฎหมาย การให้บริการสิ่งที่ใหญ่ขนาดนี้มีราคาสูง และความรับผิดชอบต่อผลลัพธ์ตกมาที่คุณ
จุดเด่น
- ทำตาม system prompt ได้ไกลกว่า hosted model ใด ๆ
- อัตราการปฏิเสธต่ำที่สุดในบรรดาที่อยู่ในดัชนีนี้
- บริบทยาวและรูปแบบ tool-calling ที่แข็งแกร่ง
ควรรู้ก่อน
- ขนาดใหญ่มาก ดังนั้นการให้บริการมีต้นทุนจริง
- guardrails น้อยลงหมายความว่าความเสี่ยง output เป็นของคุณทั้งหมด
คะแนนดัชนี
77.0
เบื้องต้น คะแนนนี้อ่านมาจากความสามารถสาธารณะของผลิตภัณฑ์ ไม่ใช่จากการสร้างใหม่ด้วยพรอมต์เดียวที่รายการที่ตรวจสอบครบถ้วนผ่านมา จึงควรถือว่าเป็นการจัดวางมากกว่าคำตัดสิน
Craft72
Speed62
Control96
Value84
- อันดับ
- 37 จาก 53
- สร้างได้
- LLM
- หมวดหมู่
- Open weights
- ผลลัพธ์
- น้ำหนักที่เผยแพร่ ภายใต้สัญญาอนุญาต permissive
- ราคา
- แผนฟรี
- เหมาะที่สุดสำหรับ
- งานที่ commercial models ปฏิเสธด้วยเหตุผลที่ไม่ถูกต้อง
คะแนนเป็นการตัดสินของกองบรรณาธิการเราเอง ถ่วงน้ำหนักความประณีต 55 ความเร็ว 10 การควบคุม 15 และคุณค่า 20
คุ้มค่าแก่การดูเช่นกัน
ดัชนีทั้งหมด- 05Kimi K3Kimi K3เบื้องต้นopen-weights model ขนาดใหญ่ที่สุดที่ใครเคยส่ง และอ่านหนึ่งล้าน token โดยไม่กะพริบOpen weightsFree tier87.5
- 06GLM-5.2GLM-5.2เบื้องต้นผลลัพธ์ระดับ frontier สัญญาอนุญาต MIT และบริบทหนึ่งล้าน token การรวมกันนี้คือเรื่องราวOpen weightsFree tier87.1
- 12Qwen 3.6Qwen 3.6เบื้องต้นopen Qwen release ที่คนส่วนใหญ่ควรรันจริง ๆ ในขนาดที่ใส่บนฮาร์ดแวร์จริงOpen weightsFree tier83.3