MODEL RELEASE (모델 출시)
미스트랄, 'Mistral Small 4' 출시
미스트랄이 공개 모델 Mistral Small 4를 Apache 2.0 라이선스로 내놨습니다. 추론용 Magistral, 이미지 이해용 Pixtral, 코딩 에이전트용 Devstral로 나뉘어 있던 능력을 하나의 모델로 합친 것이 핵심입니다. 같은 날 엔비디아가 주도하는 공개 모델 연합 'Nemotron Coalition'에 창립 멤버로 합류한다고 발표했습니다.
핵심 사실 · 한눈에 보기
- 3월 16일 미스트랄이 Mistral Small 4를 Apache 2.0 라이선스로 공개했습니다.
- 전문가 혼합(MoE) 구조로 전문가 128개 중 토큰당 4개가 작동하며, 전체 1,190억 파라미터 중 토큰당 60억 개(임베딩 포함 80억)가 쓰입니다.
- 맥락 창은 25만6천 토큰이고, 텍스트와 이미지를 입력으로 받으며, 추론 강도(reasoning_effort)를 조절할 수 있습니다.
- 최소 실행 환경은 NVIDIA HGX H100 4대, HGX H200 2대 또는 DGX B200 1대입니다.
- 같은 날 미스트랄은 엔비디아 Nemotron Coalition 창립 멤버로 합류해 공개 프런티어 모델을 공동 개발한다고 발표했습니다.
세 모델을 하나로
그동안 미스트랄 사용자는 빠른 대화용 모델, 깊이 생각하는 추론 모델, 이미지를 읽는 모델 가운데 골라야 했습니다. Small 4는 이를 하나로 합치고, reasoning_effort 값으로 빠른 답과 깊은 추론 사이를 오가게 했습니다. 일반 대화, 코딩, 에이전트 작업, 복잡한 추론을 한 모델로 처리하는 '하이브리드' 모델입니다.
미스트랄은 Small 3과 비교해 지연 최적화 설정에서 응답 완료 시간이 40% 줄고, 처리량 최적화 설정에서 초당 요청 처리가 3배 늘었다고 밝혔습니다.
짧은 답으로 같은 점수 (미스트랄 발표 기준)
미스트랄이 강조한 것은 '출력 길이 대비 성능'입니다. 추론을 켠 Small 4가 세 가지 평가에서 GPT-OSS 120B와 같거나 높은 점수를 내면서 출력은 훨씬 짧았다는 것입니다. 긴 문서 추론 평가 AA LCR에서 0.72점을 1,600자 정도 출력으로 냈고, 비슷한 성능의 Qwen 모델은 3.5~4배 긴 출력이 필요했다고 했습니다. LiveCodeBench에서는 GPT-OSS 120B보다 높은 점수를 출력 20% 적게 냈다고 밝혔습니다.
출력이 짧으면 응답이 빨라지고 비용이 줄어듭니다. 다만 비교 대상과 조건은 미스트랄이 고른 것입니다.
AI마중 POINT · 해석
봐야 할 지점
미스트랄은 미국 빅테크 밖에서 공개 모델을 꾸준히 내는 몇 안 되는 회사입니다. Apache 2.0은 상업적 이용과 수정이 자유로운 라이선스라, 데이터를 외부로 보내기 어려운 유럽 기업·기관이 자체 서버에서 돌릴 수 있습니다. vLLM, llama.cpp, SGLang, Transformers 등 주요 실행 도구에서 첫날부터 쓸 수 있게 한 것도 도입 장벽을 낮춥니다.
엔비디아와의 관계도 눈여겨볼 부분입니다. Nemotron Coalition의 첫 사업은 엔비디아 DGX Cloud에서 학습해 차기 Nemotron 4 계열의 바탕이 될 공개 기반 모델입니다. '작은' 모델이라고 해도 최소 H100 4대가 필요하다는 점은 공개 모델 운영의 현실적 비용을 보여 줍니다.
그래서 나한테는?
누구에게 의미가 있나
- 사내 AI를 직접 운영하려는 기업: 하나의 공개 모델로 대화·코딩·이미지 이해를 처리할 수 있어 관리할 모델 수를 줄일 수 있습니다. 다만 GPU 서버가 필요합니다.
- 개발자: 미스트랄 API와 AI Studio, Hugging Face, build.nvidia.com(무료 시험)에서 쓸 수 있고, NVIDIA NIM 컨테이너로도 배포됩니다.
- Le Chat 사용자: 이 발표는 공개 모델과 API 출시이며, Le Chat 기본 모델 변경 여부는 나오지 않습니다.
미확인 · 공식 발표만으로 알 수 없는 것
확인하지 못한 것
- API 가격은 발표 글에 나오지 않습니다.
- 미스트랄 발표에는 한국어 평가 결과가 없습니다.
- Nemotron Coalition의 다른 참여사와 Nemotron 4 공개 일정은 이 발표에 나오지 않습니다.
SOURCE공식 원문 + 추가 출처
- PRIMARY · 공식Introducing Mistral Small 4 | Mistral AIMistral AI · mistral.ai · 발표 2026.03.16 · 확인 2026.10.05
- SECONDARY · 공식Mistral AI partners with NVIDIA to accelerate open frontier models | Mistral AIMistral AI · mistral.ai · 발표 2026.03.16 · 확인 2026.10.05
수집 2026.09.30 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.