กลับไปยังดัชนี
04Codingคะแนนเบื้องต้น
Claude Sonnet 5
Claude Sonnet 5
ม้าศึกด้านการเขียนโค้ด: ใกล้จุดสูงสุดในงาน software จริง ในราคาที่ใช้งานได้
อัปเดต

การวิเคราะห์
Sonnet 5 คือสิ่งที่ coding agents ส่วนใหญ่รันจริง ๆ และช่องว่าง benchmark กับระดับเหนือกว่าเล็กกว่าช่องว่างราคา มันใช้ patch ที่คอมไพล์ได้ ทำตาม conventions ที่มีอยู่ของ repository และทนทานตลอด tool-calling chains ยาวที่ agent frameworks สร้างขึ้น Anthropic กำลังลดราคามัน ดังนั้นตรวจสอบอัตราปัจจุบันก่อนที่จะสร้างงบประมาณบนมัน
จุดเด่น
- อยู่ในกลุ่มโมเดลที่แข็งแกร่งที่สุดในงาน software engineering ที่ตรวจสอบได้
- ราคาเหมาะสำหรับการรันต่อเนื่องแทนที่จะรันเป็นครั้งคราว
- การเรียก tool ที่น่าเชื่อถือตลอด chains ยาว ซึ่งเป็นสิ่งที่ทำให้โมเดลอ่อนแอพัง
ควรรู้ก่อน
- ราคาปัจจุบันเป็นโปรโมชันและจะขึ้นตามวันที่ประกาศ
- เสียเปรียบ Opus จริง ๆ ในการใช้เหตุผลสถาปัตยกรรมที่ยากที่สุด
คะแนนดัชนี
87.9
เบื้องต้น คะแนนนี้อ่านมาจากความสามารถสาธารณะของผลิตภัณฑ์ ไม่ใช่จากการสร้างใหม่ด้วยพรอมต์เดียวที่รายการที่ตรวจสอบครบถ้วนผ่านมา จึงควรถือว่าเป็นการจัดวางมากกว่าคำตัดสิน
Craft89
Speed88
Control89
Value84
- อันดับ
- 04 จาก 53
- สร้างได้
- LLM
- หมวดหมู่
- Coding
- ผลลัพธ์
- ข้อความ โค้ด และ tool calls ผ่าน API
- ราคา
- ชำระเงินเท่านั้น
- เหมาะที่สุดสำหรับ
- coding agents และการผสานรวมกับ editor ในระดับขนาดใหญ่
คะแนนเป็นการตัดสินของกองบรรณาธิการเราเอง ถ่วงน้ำหนักความประณีต 55 ความเร็ว 10 การควบคุม 15 และคุณค่า 20
คุ้มค่าแก่การดูเช่นกัน
ดัชนีทั้งหมด- 10MiniMax M3MiniMax M3เบื้องต้นopen weights ที่ปรับแต่งสำหรับงาน software และ decoding เร็วที่สุดในระดับเดียวกันCoding modelFree tier84.5
- 18Step 3.7 FlashStep 3.7 Flashเบื้องต้นvision model ที่ Apache-licensed สร้างมาสำหรับ coding agents และกำหนดเส้นทางงานแทนการบุกตรงCoding modelFree tier81.6
- 43Mercury 2Mercury 2เบื้องต้นdiffusion model สำหรับข้อความ และเร็วกว่าสิ่งที่สร้างแบบปกติหลายเท่าCoding modelPaid only73.2