Skip to content
सूचकांक पर वापस
35कोडिंग एजेंटअनंतिम स्कोर

SWE-agent

SWE-agent

प्रिंसटन की शोध परियोजना, जो आपके दिए किसी भी भाषा मॉडल से गिटहब इश्यू स्वयं सुलझाती है।

को अद्यतन

SWE-agent preview

समीक्षा

SWE-agent, Princeton और Stanford का एक ओपन-सोर्स शोध टूल है जो किसी भाषा मॉडल को GitHub इश्यू स्वायत्त रूप से ठीक करने के लिए रेपो ब्राउज़ करने, फ़ाइलें पढ़ने, कोड संपादित करने और परीक्षण चलाने का एक संरचित इंटरफ़ेस देता है। यह SWE-bench Verified पर 74 प्रतिशत से ऊपर स्कोर करता है और इससे mini-swe-agent जन्मा है — एक 100-लाइन का उत्तराधिकारी जो तुलनीय बेंचमार्क परिणाम देता है। कॉन्फ़िगरेशन एक YAML फ़ाइल से होता है, जो इसे सुरक्षा कमज़ोरी शोध सहित कस्टम कार्यों के लिए लचीला रखता है। मूल रेपो अब केवल रखरखाव मोड में है क्योंकि टीम mini-swe-agent पर ध्यान केंद्रित कर रही है, इसलिए पूरी तरह प्रोडक्शन-तैयार अनुभव चाहने वाली टीमें अन्य विकल्प देखें।

जहाँ यह श्रेष्ठ है

  • मज़बूत SWE-bench बेंचमार्क विरासत के साथ ओपन-सोर्स
  • एकल YAML कॉन्फ़िग GitHub इश्यू, सुरक्षा कार्य और कस्टम वर्कफ़्लो सँभालता है
  • Claude, GPT और ओपन मॉडल सहित किसी भी LLM के साथ काम करता है

पहले जानने योग्य

  • मूल रेपो केवल रखरखाव मोड में, mini-swe-agent ने ले लिया है स्थान
  • कोई होस्टेड सेवा या UI नहीं; स्थानीय सेटअप और API कीज़ ज़रूरी

सूचकांक स्कोर

74.4

अनंतिम। यह स्कोर उत्पाद की सार्वजनिक क्षमता के आधार पर है, उस एकल-प्रॉम्प्ट पुनर्निर्माण से नहीं जिससे पूर्णतः समीक्षित प्रविष्टियाँ गुज़री हैं, इसलिए इसे किसी निर्णय की बजाय एक अनुमानित स्थान मानें।

Craft70
Speed62
Control78
Value92
क्रम
54 में से 35
निर्माण करता है
उपकरण
श्रेणी
कोडिंग एजेंट
परिणाम
स्वचालित GitHub इश्यू फ़िक्स
मूल्य-निर्धारण
निःशुल्क स्तर
सबसे उपयुक्त
शोधकर्ता और इंजीनियर, जो बेंचमार्क स्तर की स्वायत्तता आँकते हैं

स्कोर हमारा अपना संपादकीय निर्णय हैं, जिनमें शिल्प का भार 30, गति का 25, नियंत्रण का 25 और मूल्य का 20 है।