SWE-agent

AI Coding ToolsCLIPython

★ 20,310주당 +61조회 10

무엇인가

SWE-agent는 언어 모델을 코드 저장소 위에서 움직이는 자율 에이전트 실행기다. Princeton University와 Stanford University 연구진이 NeurIPS 2024에서 발표한 학술 프로젝트로, 고정된 파이프라인 대신 모델에게 최대한의 자율성을 남겨두는 실험 플랫폼 성격을 띤다. GitHub 이슈 수정 외에 공격적 사이버보안(CTF) 문제 풀이와 경쟁 프로그래밍 과제에도 같은 실행기를 쓴다.

어떻게 동작하나

동작은 모델이 도구를 호출하고 그 결과를 다시 관찰하는 반복 루프로 구성된다. 어떤 도구를 어떤 프롬프트로 노출할지, 환경을 어떻게 구성할지는 단일 `yaml` 파일 하나가 규정하며, 이 파일이 에이전트의 행동 전체를 지배한다. 실행 중에는 대화형 명령(interactive commands)과 요약기(summarizer)가 붙어 긴 상호작용을 다룬다. 공격적 사이버보안 모드는 EnIGMA라는 별도 모드로 분리되어 있다.

무엇과 다른가

같은 팀이 만든 mini-swe-agent가 SWE-agent를 대체했다. 두 도구는 SWE-bench 성능이 동등하지만 mini-swe-agent 쪽이 구현이 훨씬 단순하다. 즉 SWE-agent는 기능을 넓게 쌓은 연구용 구현이고, mini-swe-agent는 그중 핵심만 남긴 경량 구현이라는 구조적 차이가 있다. 고정 워크플로를 강제하는 에이전트와 달리 모델의 판단에 도구 선택을 맡긴다는 점도 구분점이다.

어떻게 쓰나

브라우저에서 바로 실행해 볼 수 있고, 공식 문서에서 설치, 명령줄 hello world, SWE-bench 벤치마킹 절차를 순서대로 안내한다. 설정은 코드가 아니라 `yaml` 파일을 고쳐서 바꾸며, 벤치마크 실행과 사용자 정의 작업 실행이 같은 설정 체계를 공유한다.

전제와 한계

현재 개발 역량은 대부분 mini-swe-agent로 옮겨졌고, 앞으로는 SWE-agent 대신 mini-SWE-agent를 쓰는 것이 권장된다. EnIGMA 모드는 1.0 대응이 갱신될 때까지 SWE-agent 0.7에서 사용해야 한다. 도구 호출을 지원하는 언어 모델(GPT-4o, Claude Sonnet 4 등)과 그 API 접근이 전제이며, 라이선스는 MIT다.

관련 논문 3

유사 도구