Skip to content
인덱스로 돌아가기
35코딩 에이전트잠정 점수

SWE-agent

SWE-agent

당신이 넘긴 언어 모델로 깃허브 이슈를 스스로 해결하는 프린스턴 연구 프로젝트.

업데이트

SWE-agent preview

리뷰

SWE-agent는 프린스턴과 스탠퍼드의 오픈소스 연구 도구로, 언어 모델에 저장소 탐색, 파일 읽기, 코드 편집, 테스트 실행을 위한 구조화된 인터페이스를 제공해 GitHub 이슈를 자율적으로 해결한다. SWE-bench Verified에서 74% 이상의 점수를 기록했으며, 유사한 벤치마크 성능을 보이는 100줄짜리 후속 도구 mini-swe-agent를 낳았다. 단일 YAML 파일로 설정이 가능해 보안 취약점 연구를 포함한 커스텀 작업에도 유연하게 쓸 수 있다. 원본 저장소의 개발은 유지 보수 모드로 전환됐고 팀은 mini-swe-agent에 집중하고 있어, 완전히 상용화된 경험을 원하는 팀은 다른 도구를 봐야 한다.

두드러지는 점

  • 강력한 SWE-bench 벤치마크 실적을 가진 오픈소스
  • YAML 설정 하나로 GitHub 이슈, 보안 작업, 커스텀 워크플로를 모두 처리
  • Claude, GPT, 오픈 모델을 포함한 어떤 LLM과도 연동 가능

미리 알아두면 좋은 것

  • 원본 저장소는 유지 보수 모드, mini-swe-agent로 계승됨
  • 호스팅 서비스나 UI 없음, 로컬 설정과 API 키 필요

인덱스 점수

74.4

잠정 점수입니다. 이 점수는 전체 검토 항목이 거친 단일 프롬프트 재현 테스트가 아닌 제품의 공개 기능 정보를 기반으로 합니다. 확정 평가가 아닌 잠정 순위로 참고하세요.

Craft70
Speed62
Control78
Value92
순위
54개 중 35위
빌드 대상
도구
카테고리
코딩 에이전트
결과물
자동화된 GitHub 이슈 수정
요금
무료 플랜
이런 분께 적합
벤치마크 수준의 자율성을 재는 연구자와 엔지니어

점수는 저희 자체 편집 판단이며, 완성도 30, 속도 25, 제어력 25, 가성비 20의 가중치로 합산합니다.