SWE-agent
무엇인가
SWE-agent는 언어 모델을 코드 저장소 위에서 움직이는 자율 에이전트 실행기다. Princeton University와 Stanford University 연구진이 NeurIPS 2024에서 발표한 학술 프로젝트로, 고정된 파이프라인 대신 모델에게 최대한의 자율성을 남겨두는 실험 플랫폼 성격을 띤다. GitHub 이슈 수정 외에 공격적 사이버보안(CTF) 문제 풀이와 경쟁 프로그래밍 과제에도 같은 실행기를 쓴다.
어떻게 동작하나
동작은 모델이 도구를 호출하고 그 결과를 다시 관찰하는 반복 루프로 구성된다. 어떤 도구를 어떤 프롬프트로 노출할지, 환경을 어떻게 구성할지는 단일 `yaml` 파일 하나가 규정하며, 이 파일이 에이전트의 행동 전체를 지배한다. 실행 중에는 대화형 명령(interactive commands)과 요약기(summarizer)가 붙어 긴 상호작용을 다룬다. 공격적 사이버보안 모드는 EnIGMA라는 별도 모드로 분리되어 있다.
무엇과 다른가
같은 팀이 만든 mini-swe-agent가 SWE-agent를 대체했다. 두 도구는 SWE-bench 성능이 동등하지만 mini-swe-agent 쪽이 구현이 훨씬 단순하다. 즉 SWE-agent는 기능을 넓게 쌓은 연구용 구현이고, mini-swe-agent는 그중 핵심만 남긴 경량 구현이라는 구조적 차이가 있다. 고정 워크플로를 강제하는 에이전트와 달리 모델의 판단에 도구 선택을 맡긴다는 점도 구분점이다.
어떻게 쓰나
브라우저에서 바로 실행해 볼 수 있고, 공식 문서에서 설치, 명령줄 hello world, SWE-bench 벤치마킹 절차를 순서대로 안내한다. 설정은 코드가 아니라 `yaml` 파일을 고쳐서 바꾸며, 벤치마크 실행과 사용자 정의 작업 실행이 같은 설정 체계를 공유한다.
전제와 한계
현재 개발 역량은 대부분 mini-swe-agent로 옮겨졌고, 앞으로는 SWE-agent 대신 mini-SWE-agent를 쓰는 것이 권장된다. EnIGMA 모드는 1.0 대응이 갱신될 때까지 SWE-agent 0.7에서 사용해야 한다. 도구 호출을 지원하는 언어 모델(GPT-4o, Claude Sonnet 4 등)과 그 API 접근이 전제이며, 라이선스는 MIT다.
관련 논문 3
유사 도구
- gptme터미널에서 실행되는 개인 AI 에이전트 CLI다. 셸·Python·브라우저·비전 도구를 갖추고 여러 LLM 제공자와 로컬 llama.cpp를 지원한다.
- skillkitSKILL.md의 YAML 메타데이터와 본문을 읽어 파이썬 에이전트가 스킬을 스스로 찾아 쓰게 만드는 라이브러리다. 점진적 공개 로딩과 스크립트 실행 절차를 규정한다.
- pr-agentPR 코멘트나 CLI 명령으로 AI 코드 리뷰를 실행하는 Python 도구다. GitHub·GitLab·Bitbucket·Azure DevOps에 붙는다.
- open-code-reviewGit diff를 결정적 파이프라인과 LLM 에이전트에 나눠 넘겨 줄 단위 리뷰 코멘트를 만드는 Go CLI다. 파일 번들링과 규칙 매칭을 엔지니어링 로직으로 고정한다.
- ouroboros자기 구현을 스스로 고쳐 쓰는 범용 AI 에이전트다. 데스크톱 앱과 헤드리스 CLI로 실행되며 기억과 정체성을 재시작 후에도 유지한다.
- browser-useLLM이 브라우저를 직접 조작하도록 만드는 파이썬 에이전트 라이브러리다. 자연어 작업을 주면 페이지를 읽고 클릭·입력·스크롤을 스스로 결정해 실행한다.