humanizer-ru
무엇인가
humanizer-ru는 러시아어 텍스트에 남은 채팅 인터페이스 복사 흔적을 탐지·제거하고, 편집 전후의 사실 관계를 대조하는 절차를 에이전트에 주입하는 스킬 팩이다. 규율하는 영역은 문장 스타일이 아니라 텍스트 위생, 즉 붙여넣기 과정에서 딸려 온 아티팩트와 그 처리 순서다. 클래스 A는 채팅 UI에서 복사할 때 생기는 딱딱한 흔적, 클래스 B는 비가시 문자나 숨은 자판 배열 같은 맥락 지표로 구분한다.
어떻게 동작하나
동작은 SKILL.md의 규칙과 함께 배포되는 명령 묶음으로 이뤄진다. humanizer-markers가 40개 정규식 마커를 스캔해 파일·행·마커·클래스·단편을 보고하고, humanizer-clean이 코드·frontmatter·URL·HTML 속성·ZWJ 이모지 클러스터 같은 보호 영역을 건드리지 않은 채 지원되는 아티팩트만 제거한다. humanizer-facts는 숫자·날짜·URL·이름·인용·부정·양태를 대조하고, humanizer-report가 편집 보고서를 만든다. 같은 기능이 humanizer-mcp stdio 서버로도 노출되어 MCP 설정 한 줄로 에이전트 환경에 붙는다.
무엇과 다른가
프롬프트에 "복사 흔적을 지워 달라"고 한 줄 쓰는 방식과 다르다. 마커 목록이 markers.v1.json으로 버전 관리되고, 비가시 문자는 safe·ambiguous·dangerous 위험 등급으로 나뉘어 제거 범위가 명시된다. 반환 코드가 계약으로 고정되어 rc=1은 마커 발견, rc=0은 잔여 없음, rc=2는 입력 읽기 실패를 뜻하므로 CI 게이트로 쓸 수 있다. 산문 규칙만 담는 CLAUDE.md·AGENTS.md 계열 파일과 달리, 실행 가능한 검사·정리·대조 명령과 그 실패 조건을 함께 담는다.
어떻게 쓰나
설치는 pip install humanizer-ru 한 줄이다. 첫 사용은 humanizer-markers --scan input.txt로 흔적을 찾고, humanizer-clean --in-place input.txt로 지원 아티팩트를 제거하며 원본을 .bak에 남기고, humanizer-facts diff로 사실 손실을 확인하는 순서다. 편집 전 결과를 미리 보려면 humanizer-clean --diff를 쓴다. MCP로 붙일 때는 uvx --from humanizer-ru==3.36.4 humanizer-mcp를 stdio 서버로 등록한다.
전제와 한계
전제와 한계가 분명하다. 기본 프로필은 러시아어이고, 영어 텍스트는 --language en 또는 auto를 붙여야 하며 이때 러시아어 문체 휴리스틱은 적용되지 않는다. 도구와 스킬 모두 저자 판정을 내리지 않는다. 클래스 B, 위키 마크업, 플레이스홀더는 제거되지 않고 잔여로 남아 rc=1을 반환하므로 완전한 청정을 주장하지 않는다. 보호 영역 불변식이 깨지면 결과를 아예 쓰지 않는다.