Skip to content
กลับไปยังดัชนี
35ตัวแทนเขียนโค้ดคะแนนเบื้องต้น

SWE-agent

SWE-agent

โครงการวิจัยจากพรินซ์ตัน ที่แก้ปัญหาบน GitHub ได้เองด้วยโมเดลภาษาที่คุณจัดหามาให้

อัปเดต

SWE-agent preview

การวิเคราะห์

SWE-agent คือเครื่องมือวิจัยโอเพนซอร์สจาก Princeton และ Stanford ที่มอบอินเทอร์เฟซที่มีโครงสร้างให้โมเดลภาษาสำรวจที่เก็บโค้ด อ่านไฟล์ แก้ไขโค้ด และรันการทดสอบเพื่อแก้ปัญหา GitHub โดยอัตโนมัติ ทำคะแนนเกิน 74 เปอร์เซ็นต์บน SWE-bench Verified และได้สร้าง mini-swe-agent ซึ่งเป็นผู้สืบทอด 100 บรรทัดที่มีผลลัพธ์เกณฑ์มาตรฐานใกล้เคียงกัน การตั้งค่าทำผ่านไฟล์ YAML ไฟล์เดียว มีความยืดหยุ่นสำหรับงานกำหนดเองรวมถึงการวิจัยช่องโหว่ความปลอดภัย การพัฒนาที่เก็บหลักอยู่ในโหมดบำรุงรักษาขณะทีมมุ่งเน้น mini-swe-agent ดังนั้นทีมที่ต้องการประสบการณ์ production พร้อมใช้ควรมองที่อื่น

จุดเด่น

  • โอเพนซอร์สพร้อมประวัติเกณฑ์มาตรฐาน SWE-bench ที่แข็งแกร่ง
  • ไฟล์ YAML ไฟล์เดียวครอบคลุมปัญหา GitHub งานความปลอดภัย และเวิร์กโฟลว์กำหนดเอง
  • ทำงานกับ LLM ใดก็ได้ รวมถึง Claude, GPT และโมเดลโอเพน

ควรรู้ก่อน

  • ที่เก็บหลักอยู่ในโหมดบำรุงรักษาเท่านั้น สืบทอดโดย mini-swe-agent
  • ไม่มีบริการโฮสต์หรือ UI ต้องตั้งค่าในเครื่องและมี API key

คะแนนดัชนี

74.4

เบื้องต้น คะแนนนี้อ่านมาจากความสามารถสาธารณะของผลิตภัณฑ์ ไม่ใช่จากการสร้างใหม่ด้วยพรอมต์เดียวที่รายการที่ตรวจสอบครบถ้วนผ่านมา จึงควรถือว่าเป็นการจัดวางมากกว่าคำตัดสิน

Craft70
Speed62
Control78
Value92
อันดับ
35 จาก 54
สร้างได้
เครื่องมือ
หมวดหมู่
ตัวแทนเขียนโค้ด
ผลลัพธ์
การแก้ไขปัญหา GitHub อัตโนมัติ
ราคา
แผนฟรี
เหมาะที่สุดสำหรับ
นักวิจัยและวิศวกรที่ประเมินความเป็นอิสระระดับเกณฑ์มาตรฐาน

คะแนนเป็นการตัดสินของกองบรรณาธิการเราเอง ถ่วงน้ำหนักความประณีต 30 ความเร็ว 25 การควบคุม 25 และคุณค่า 20