결정 전용 모델 'Jev' 활용 사례 20여 개 모은 사이트 공개
중국 개발자 커뮤니티 V2EX에 결정(decision) 특화 모델 'Jev'를 다룬 프로젝트를 모아둔 사이트가 공개됐다. 주소는 whatcanjevdo.com이며, 게시자는 이 사이트에 현재 20여 개의 Jev 관련 프로젝트를 정리해 두었다고 설명했다. 게시글 자체는 자신이 만든 사이트를 알리는 홍보 성격의 글이고, 별도의 벤치마크 수치나 제3자 검증 결과는 담기지 않았다.
Jev는 ChatGPT나 Claude 같은 생성형 모델과는 결이 다르다고 소개된다. 문장을 만들어내는 대신, 정해진 후보 가운데 하나를 고르는 식의 구체적인 판단 작업을 맡는다는 것이다. 게시자에 따르면 공식 문서에는 Jev의 위치 설정과 API 호출 방식, 그리고 Classification(분류)·Routing(라우팅)·Scoring(점수화) 같은 기능이 정리되어 있다.
이런 판단 작업은 그동안 대형 언어모델에 함께 맡겨온 영역이다. Jev는 이를 별도 모델로 떼어내 전용으로 처리하자는 접근을 취한다. 사이트에 모인 사례들은 이 차이가 실무에서 어떤 형태로 나타나는지를 보여주는 데 초점이 맞춰져 있다.
게시자가 특히 이해가 쉬운 예로 든 것은 브라우저 에이전트다. 이런 에이전트는 한 단계를 실행할 때마다 다음에 무엇을 할지 판단해야 하는데, 이 '다음 행동 선택'을 Jev가 맡고 실제 조작은 브라우저 도구가 수행하는 구조다. 후보 동작이 한정되어 있고 현재 상태가 주어지는 상황에서 하나를 고르는 일이라는 점이 Jev의 용도와 맞아떨어진다는 설명이다.
실무 관점에서 보면, 에이전트 루프 안에서 매번 발생하는 선택·분류·라우팅을 범용 LLM 호출로 처리할지 전용 모델로 분리할지가 설계 선택지로 추가되는 셈이다. 다만 이번 글은 사례 수집 단계의 소개에 그치므로, 어떤 구성이 실제로 더 나은지는 개별 프로젝트를 직접 확인해야 한다.
한계도 분명하다. 게시자 스스로 사이트가 아직 매우 초기 단계라고 밝히고 있고, 정리된 프로젝트의 품질이나 Jev 자체의 성능을 뒷받침하는 독립적인 자료는 제시되지 않았다. 공식 문서의 구체적인 주소도 글에는 포함되어 있지 않아, API 세부 사양은 별도로 찾아봐야 한다.
관련 글
- LLM 로그확률로 이미지까지 분류하는 Jev 스타일 래퍼 공개LLM이 내놓는 토큰 로그확률을 읽어 분류기처럼 활용하는 Jev 스타일 요청 형식이 공개됐다. 여기에 이미지 첨부 필드를 더해 웹캠 프레임을 실시간으로 판정하는 파이썬 예제까지 함께 올라왔으며, RTX 3090에서 초당 1프레임 수준의 처리량을 기록했다.
- AI가 포켓몬 레드를 플레이하며 결정과 확률을 보여주는 Show HN 프로젝트다Show HN에 AI가 포켓몬 레드를 플레이하는 'Jev Plays Pokémon Red'가 공개됐다. 화면 오른쪽 패널에서 매 결정과 각 선택의 확률을 실시간으로 보여주며, AI가 공략 가이드에 의존해 진행한다는 전제도 드러난다.
- Jev와 Decitron은 둘 다 결정 AI지만 같은 게 아니다TypeSafe AI의 Jev는 지금 무엇을 고를지 즉시 판단하는 결정 AI다. Zhongke Wenge의 Decitron은 세계 모델과 다중 에이전트 시뮬레이션으로 미래 경로를 비교하는 결정 AI다. 둘 다 AI 출력을 텍스트에서 판단·행동으로 옮기려 하지만, 다루는 불확실성의 종류가 다르다.
- Jev에게 '다음 글자'만 물어 챗봇으로 만든 실험, jevchat 공개결정 모델 Jev에게 매 단계 다음 기호를 묻고 확률 분포에서 샘플링해 문장을 만들어내는 실험 도구 jevchat이 공개됐다. 여러 샘플링 전략과 알파벳, 빔 탐색을 지원하며 오프라인 테스트 158개를 갖췄지만 비용은 비현실적이고 결과는 재미를 위한 것이다.
- 에이전트 라우팅에 70B 모델은 과하다는 Laya와 Jev 비공식 비교가 나왔다Convai Innovations가 공개한 421M 결정 모델 Laya와 TypeSafe의 상용 엔진 Jev를 비교한 비공식 평가가 나왔다. 속도와 캘리브레이션 수치가 공개됐지만, 통제된 대조 실험이 아니라는 전제가 붙는다.