Rust 하드 차단과 Qwen3Guard를 겹친 2계층 안전 필터, 프로덕션 적용 사례 공개

开源中国19일 전조회 8

Rust로 구현한 저수준 차단 계층 위에 Qwen3Guard 기반의 AI 의미 판정 계층을 얹는 2계층 안전 관리 아키텍처 사례가 중국 오픈소스 커뮤니티 oschina에 올라왔다. 글은 이 구조를 실제 프로덕션 환경에 적용한 뒤의 경험과 공개 벤치마크, 그리고 시스템이 감당하지 못하는 영역에 대한 설명을 함께 담았다고 소개한다.

구성은 두 단계로 나뉜다. 아래층은 Rust로 작성한 하드 차단 계층으로, 요청이 더 깊이 들어가기 전에 결정론적으로 끊어내는 역할을 맡는다. 위층은 Qwen3Guard가 입력의 의미를 다국어로 판단해, 단순 규칙만으로는 걸러지지 않는 표현을 잡아내는 역할이다. 원문은 이 조합을 "Rust 저수준 하드 차단 + Qwen3Guard AI 다국어 의미 판단"으로 요약한다. 글에는 두 계층을 붙이면서 겪은 문제들과 공개 벤치마크 데이터, 그리고 이 아키텍처가 실제로 어디까지 커버하는지에 대한 솔직한 공개가 포함됐다고 적혀 있다.

이런 이중 구조가 나오는 배경은 양쪽 접근의 한계가 뚜렷하기 때문이다. 규칙 기반 필터는 빠르고 예측 가능하지만 다국어 표현이나 우회 시도에 약하고, 모델 기반 판정은 유연하지만 지연과 비용이 붙고 그 자체가 우회 대상이 될 수 있다. 그래서 빠른 결정론적 계층과 느린 의미 계층을 분리해 배치하는 방식이 실무에서 늘고 있다. 이 글은 특정 생태계 기술 백서 시리즈의 네 번째 글로 소개됐다.

개발자 입장에서 참고할 지점은 구조 자체보다 경계 설정이다. 어느 수준의 요청을 Rust 계층에서 즉시 끊고, 어떤 판단을 모델로 넘길지 정하는 것이 성능과 검출률을 동시에 좌우한다. 다만 확보된 원문은 도입부까지만 제공돼 벤치마크 수치, 처리량, 사용한 모델 버전, 지원 언어 범위 같은 세부 정보는 확인되지 않는다. 구체적인 수치와 구현 세부는 원문 전체를 직접 확인해야 한다.