Opus 5.5 기본 사고 등급이 medium으로, 기존 xhigh 사용자들은 재조정 고민

V2EX18일 전조회 37

추론 모델의 '사고 등급(thinking level)' 기본값이 어디로 잡히느냐는 실제 사용 비용과 응답 품질을 함께 좌우한다. 커뮤니티 게시판에 Opus 5.5의 기본 사고 등급이 medium으로 설정됐다는 공유가 올라왔다. 별도 설정 없이 모델을 호출하는 사용자라면 이전 버전과 같은 작업을 해도 투입되는 추론 예산이 달라질 수 있다는 뜻이다.

게시글 작성자는 이전에 Opus 5를 쓸 때 xhigh 등급을 선택했다고 밝히면서, Opus 5.5에서는 high 정도면 충분한지 고민된다고 적었다. 근거로는 공식 설명을 인용해 Opus 5.5 자체가 더 많이 사고한다는 점을 들었다. 다만 그 설명이 어떤 문서나 릴리스 노트에 근거한 것인지는 게시글에서 확인되지 않는다.

배경에는 추론 시점 연산량을 조절하는 파라미터가 있다. thinking level이나 reasoning effort 같은 등급을 높이면 모델이 답을 내기 전에 더 많은 토큰을 써서 따져보게 되고, 그만큼 정확도가 오르는 대신 토큰 소모와 지연 시간이 커진다. 기본값이 낮아지면 아무 설정도 건드리지 않는 워크플로의 비용 구조가 조용히 바뀐다.

실무에서는 두 방향을 모두 점검해야 한다. API나 코딩 도구에서 등급을 명시하지 않고 쓰던 파이프라인은 이전보다 적은 추론 예산으로 돌아갈 수 있으니, 복잡한 리팩터링이나 원인 파악이 어려운 디버깅처럼 깊은 추론이 필요한 작업에서 결과가 부족해지지 않는지 확인하는 게 좋다. 반대로 기존에 xhigh를 고정해 쓰던 팀은 high로 낮춰도 자체 평가에서 성능이 유지되는지 측정해볼 만하다. 등급을 작업 종류별로 나눠 지정하는 방식이 비용과 품질을 함께 관리하기 쉽다.

이번 내용은 개인 사용자의 짧은 게시글 하나에 기반한다. 기본값이 언제부터 바뀌었는지, 웹·API·CLI 중 어디에 적용되는지, 공식 문서상 근거가 무엇인지는 원문에서 확인되지 않는다. 실제 적용 여부와 범위는 각자 사용하는 환경에서 직접 확인해야 한다.

관련 글