claude-token-efficient
무엇인가
claude-token-efficient는 Claude Code가 응답을 생성할 때의 출력 길이와 형식을 규율하는 단일 규칙 파일이다. 다루는 문제 영역은 출력 토큰 비용이다. 모델의 추론 품질이 아니라 답변에 붙는 인사말·마무리 문장·질문 재진술·요청 범위 밖 제안·불필요한 추상화 계층, 그리고 em dash·스마트 따옴표 같은 비ASCII 문자를 규칙으로 차단한다.
어떻게 동작하나
배포 형태는 프로젝트 루트에 두는 CLAUDE.md 한 파일이다. Claude Code가 세션마다 이 파일을 컨텍스트로 자동 로드하므로 별도 훅이나 슬래시 명령 없이 적용된다. 핵심 규칙은 파일을 먼저 읽고, 완전한 해결책을 한 번에 쓰고, 테스트를 한 번만 돌리고, 요청하지 않은 추상화를 만들지 않는다는 네 가지다. 저장소는 루트 파일을 최소 규칙 집합으로 유지하고, profiles/ 디렉터리에 v5·v6·v8 세 가지 버전별 구성 세트를, benchmark/ 디렉터리에 출력 토큰 측정 스크립트를 함께 둔다.
무엇과 다른가
같은 목적의 대안과 구조가 다르다. 채팅에 규칙을 붙여 넣는 방식은 세션마다 반복 입력이 필요하고, "간결하게 답하라" 같은 일반 지시는 실제 실패 모드를 겨냥하지 못한다. 이 스킬은 전역(~/.claude/CLAUDE.md)·프로젝트·하위 디렉터리 단위로 CLAUDE.md를 겹쳐 쌓는 구성을 전제로, 톤·형식 규칙은 전역에, 프로젝트 제약은 프로젝트 파일에, 작업별 규칙은 하위 디렉터리에 두게 한다. 루트 파일을 짧게 유지하는 것 자체가 설계 원칙이다.
어떻게 쓰나
설치는 파일 복사다. 프로젝트 루트에 CLAUDE.md를 두면 다음 세션부터 적용된다. 일회성 작업이면 채팅에 "Rules: Read files first. Write complete solution. Test once. No over-engineering." 한 줄을 붙여 넣는 것으로 대체된다. 압축 강도를 조절하려면 profiles/의 버전별 구성 세트 중 하나를 골라 기본 파일과 조합한다. 벤치마크를 재현하려면 python3 benchmark/run.py -n 5 --model opus를 실행하고 모델별 리포트를 읽는다.
전제와 한계
지원 대상은 Claude Code다. 벤치마크는 Claude에서만 실행됐고, 규칙 자체는 모델 비의존적이지만 llama.cpp·Mistral 같은 로컬 모델에서의 결과는 검증되지 않았다. 규칙 파일은 매 턴 입력 토큰을 추가하므로 출력량이 충분히 큰 워크플로에서만 순절감이 발생한다. 현재 최소 구성의 출력 토큰 감소는 haiku 약 4%, sonnet 약 12%, opus 약 7%로 측정됐고, 63% 수치는 더 엄격한 규칙 프로필에서 나온다. 최신 모델 기준선은 이미 프리앰블·아부·"as an AI"·스마트 따옴표가 0%로 측정되어, 그런 동작을 겨냥한 규칙은 입력 비용만 늘린다.