인덱스로 돌아가기
35코딩 에이전트잠정 점수
SWE-agent
SWE-agent
당신이 넘긴 언어 모델로 깃허브 이슈를 스스로 해결하는 프린스턴 연구 프로젝트.
업데이트

리뷰
SWE-agent는 프린스턴과 스탠퍼드의 오픈소스 연구 도구로, 언어 모델에 저장소 탐색, 파일 읽기, 코드 편집, 테스트 실행을 위한 구조화된 인터페이스를 제공해 GitHub 이슈를 자율적으로 해결한다. SWE-bench Verified에서 74% 이상의 점수를 기록했으며, 유사한 벤치마크 성능을 보이는 100줄짜리 후속 도구 mini-swe-agent를 낳았다. 단일 YAML 파일로 설정이 가능해 보안 취약점 연구를 포함한 커스텀 작업에도 유연하게 쓸 수 있다. 원본 저장소의 개발은 유지 보수 모드로 전환됐고 팀은 mini-swe-agent에 집중하고 있어, 완전히 상용화된 경험을 원하는 팀은 다른 도구를 봐야 한다.
두드러지는 점
- 강력한 SWE-bench 벤치마크 실적을 가진 오픈소스
- YAML 설정 하나로 GitHub 이슈, 보안 작업, 커스텀 워크플로를 모두 처리
- Claude, GPT, 오픈 모델을 포함한 어떤 LLM과도 연동 가능
미리 알아두면 좋은 것
- 원본 저장소는 유지 보수 모드, mini-swe-agent로 계승됨
- 호스팅 서비스나 UI 없음, 로컬 설정과 API 키 필요
인덱스 점수
74.4
잠정 점수입니다. 이 점수는 전체 검토 항목이 거친 단일 프롬프트 재현 테스트가 아닌 제품의 공개 기능 정보를 기반으로 합니다. 확정 평가가 아닌 잠정 순위로 참고하세요.
Craft70
Speed62
Control78
Value92
- 순위
- 54개 중 35위
- 빌드 대상
- 도구
- 카테고리
- 코딩 에이전트
- 결과물
- 자동화된 GitHub 이슈 수정
- 요금
- 무료 플랜
- 이런 분께 적합
- 벤치마크 수준의 자율성을 재는 연구자와 엔지니어
점수는 저희 자체 편집 판단이며, 완성도 30, 속도 25, 제어력 25, 가성비 20의 가중치로 합산합니다.



