Mistral이 1.05T 파라미터 오픈웨이트 멀티모달 모델 Large 4를 공개했다

Hacker News4일 전조회 1

Mistral AI가 새 플래그십 모델인 Mistral Large 4를 공개했다. 오픈웨이트로 배포되는 범용 멀티모달 모델이며, 현재 퍼블릭 프리뷰 단계다. 텍스트만 다루던 이전 세대와 달리 이미지 입력을 모델 자체에 포함시킨 것이 이번 발표의 핵심이다.

구조는 세밀하게 쪼갠 전문가 혼합(Mixture-of-Experts) 방식이다. 전체 파라미터는 1.05T에 달하지만 추론 시 실제로 활성화되는 파라미터는 49B 수준이다. 여기에 1.6B 규모의 비전 인코더가 붙어 시각 정보를 처리한다. 전체 가중치를 다 쓰지 않고 일부 전문가만 태우는 구조이기 때문에, 1T급 모델치고는 서빙 비용을 현실적인 범위로 끌어내리는 것이 목표로 읽힌다.

공개 상태는 퍼블릭 프리뷰이고 문서에 표기된 버전은 26.10이다. 날짜는 2026년 10월 6일로 적혀 있다. 정식 출시가 아니라 프리뷰라는 점은 API 스펙이나 가중치 배포 조건이 이후 바뀔 수 있다는 뜻이므로, 프로덕션 도입을 검토한다면 버전 고정 전략을 함께 세워야 한다.

API 표면을 보면 이 모델이 단순 채팅 완성을 넘어 에이전트 실행까지 염두에 둔 제품이라는 게 드러난다. 엔드포인트는 /v1/chat/completions, /v1/conversations, /v1/agents 세 갈래로 나뉜다. 구조화 출력, 함수 호출, 문서 QnA, 프리픽스(prefix) 기능이 chat/completions와 conversations 양쪽에서 제공되고, 에이전트와 대화, 내장 도구(built-in tools)는 agents와 conversations 경로에 묶여 있다.

이 배치가 실무에서 갖는 의미는 분명하다. 구조화 출력과 함수 호출이 기본 제공된다는 것은 별도 파서나 프롬프트 해킹 없이 JSON 스키마 기반 응답을 받아 백엔드 로직에 바로 꽂을 수 있다는 뜻이다. 문서 QnA가 1급 기능으로 들어간 점도 눈에 띄는데, RAG 파이프라인을 직접 조립하지 않고도 문서 질의 기능을 모델 호출 한 번으로 처리할 수 있는 경로가 열린다.

에이전트와 내장 도구가 별도 엔드포인트로 분리된 것도 주목할 부분이다. 대화 상태를 서버가 들고 가는 conversations 경로와 도구 실행을 전제로 한 agents 경로가 나뉘어 있으니, 멀티턴 에이전트를 만들 때 상태 관리와 도구 호출을 어디에 둘지 설계 선택지가 생긴다. 다만 내장 도구가 구체적으로 무엇을 포함하는지는 이번 문서만으로는 확인되지 않는다.

배경에는 오픈웨이트 진영의 규모 경쟁이 있다. 최근 몇 년간 공개 가중치 모델은 파라미터 총량을 키우면서도 MoE로 활성 파라미터를 눌러 추론 비용을 통제하는 방향으로 움직여 왔다. Mistral이 자사 플래그십 라인에 1T급 MoE와 비전 인코더를 동시에 얹었다는 것은, 폐쇄형 API 진영과의 격차를 좁히는 동시에 자체 호스팅을 원하는 팀을 붙잡겠다는 전략으로 풀이된다.

주의할 점도 있다. 이번 문서는 모델 사양과 API 표면을 나열하는 데 집중하고 있어, 벤치마크 점수나 라이선스 조건, 가중치 배포 형태에 대한 정보는 담겨 있지 않다. 오픈웨이트라고 표기돼 있지만 실제 사용 조건은 별도 확인이 필요하다. 프리뷰 단계라는 점까지 감안하면, 지금 시점에서 이 모델을 평가할 때는 성능 수치보다 제공되는 기능 집합과 엔드포인트 구조를 기준으로 삼는 편이 안전하다.