
Mistral Medium 3 — 벤치마크, 성능 및 사용 사례
Mistral Medium 3는 Mistral이 개발한 독점 AI 모델로, 128K 토큰 컨텍스트 윈도우를 갖춘 Advanced 등급에 속합니다. 벤치마크 점수, 강점 및 권장 사용 사례를 알아보세요....
Mistral Large 3는 까다로운 프로덕션 워크로드에 적합한 고급 AI 모델로, Mistral이 개발하여 2025년 12월에 출시했습니다. 오픈 가중치 모델로서 학습된 가중치가 공개적으로 제공되어 자체 호스팅, 독점 데이터로 파인튜닝, 또는 API 의존성 없이 온프레미스에서 실행할 수 있습니다. 256K 토큰 컨텍스트 윈도우를 지원하여 대부분의 문서 및 다중 턴 애플리케이션에 적합합니다.
FlowHunt AI 리더보드에서 24개 추적 모델 중 하나로, 3개 벤치마크에서 평가되었습니다. 주요 점수: MATH-500 93.6%(4개 중 1위), MMLU-Pro 73.1%(8개 중 5위), GPQA Diamond 43.9%(14개 중 14위).
Mistral Large 3는 2025년 12월 2일에 Mistral의 가장 강력한 상용 모델이자, 중요한 점은 Apache 2.0 라이선스의 오픈 가중치 모델로 출시되었습니다. 675B 전체 MoE 아키텍처에서 41B 활성 파라미터를 가진 이 모델은 Apache 라이선스가 적용된 프론티어급 모델 중 가장 크고 강력합니다. Mistral은 Large 3를 유럽 기업의 요구에 특화하여 설계했습니다: EU 데이터 센터에 배포 가능, GDPR 준수(데이터가 배포 지역을 벗어나지 않음), 많은 오픈 가중치 모델의 제한적인 라이선스 조건 없이 상용 애플리케이션에 사용 가능. MMLU-Pro 점수 84.2%와 견고한 과학 추론 프로필 덕분에 미국 기반 API 제공업체로 데이터를 보내지 않고 강력한 AI 기능이 필요한 유럽 규제 산업(금융, 의료, 법률)의 기본 선택이 되었습니다.
참고: 엔터프라이즈 범용 모델, Apache 2.0. 하드 추론 약점(GPQA 43.9%).
Rank among all 24 models tracked on this leaderboard. SR = self-reported · 3P / AA / C = independently verified.
| Benchmark | Score | Rank | Source | What it measures |
|---|---|---|---|---|
| GPQA Diamond | 43.9% | 14 of 14 | 3P | Graduate-level Google-proof science Q&A |
| MMLU-Pro | 73.1% | 5 of 8 | 3P | Hard knowledge reasoning, 12K questions |
| MATH-500 | 93.6% | 1 of 4 | 3P | Hendrycks math (500 problems) |
Head-to-head benchmark comparison with other Advanced-tier models. Higher is better for all metrics.
| Benchmark | Mistral Large 3 | Claude Sonnet 4.6 | GPT-4.1 |
|---|---|---|---|
| GPQA ◇ | 43.9% | — | — |
| MMLU-P | 73.1% | — | — |
| MATH | 93.6% | 89.0% | — |
Mistral AI는 2023년 4월 Arthur Mensch(前 Google DeepMind), Guillaume Lample, Timothée Lacroix(이상 前 Meta AI Research)가 설립한 프랑스 AI 회사입니다. 이 회사는 상업용 API 사업과 전략적인 오픈웨이트 모델 공개를 결합하여 유럽의 생성형 AI 챔피언으로 자리매김하고 있습니다. Mistral의 주력 Large 시리즈 및 Apache 2.0 라이선스 모델은 대부분의 AI 리더보드에서 가장 눈에 띄는 비미국·비중국 공급업체가 되게 했습니다. 이 회사는 파리에 EU 본사를 두고 있으며, GDPR 및 EU 규정 준수를 강조하고, 폐쇄형 API 시스템에 비해 오픈웨이트 모델에 대한 더 가벼운 규제를 요구하는 독특한 규제 철학을 표명하고 있습니다.
사용 사례
Mistral Large 3는 GPQA Diamond에서 43%(14개 모델 중 14위)를 달성합니다. 일반적인 과학 Q&A를 견고한 수준으로 처리하지만, 프론티어 모델은 가장 어려운 대학원 수준 문제에서 25%포인트 이상 높은 점수를 보입니다.
Mistral Large 3는 오픈 가중치 모델(41B/675B MoE)입니다 — 학습된 가중치가 공개적으로 다운로드 및 자체 배포가 가능합니다. 자체 GPU 하드웨어나 프라이빗 클라우드에서 실행하여 데이터가 환경을 벗어나지 않도록 보장하고, 대규모 사용 시 토큰당 API 비용을 없애거나, 독점 데이터셋으로 모델을 파인튜닝할 수 있습니다.
더 비교해보기
11개 벤치마크에 걸친 24개 모델 모두 비교 — 정렬 가능, 출처 표시, 2026년 6월 업데이트.

Mistral Medium 3는 Mistral이 개발한 독점 AI 모델로, 128K 토큰 컨텍스트 윈도우를 갖춘 Advanced 등급에 속합니다. 벤치마크 점수, 강점 및 권장 사용 사례를 알아보세요....

Mixtral 8x7B는 Mistral의 오픈 가중치 AI 모델(12.9B/46.7B MoE)로, Legacy 등급으로 분류되며 32K 토큰 컨텍스트 창을 제공합니다. FlowHunt에서 직접 사용할 수 있습니다. 벤치마크 점수, 강점 및 권장 사용 사례를 확인해보세요....

미스트랄 AI와 그들이 제공하는 LLM 모델에 대해 알아보세요. 이러한 모델이 어떻게 사용되는지, 그리고 무엇이 이들을 특별하게 만드는지 확인해보세요....
쿠키 동의
당사는 귀하의 브라우징 경험을 향상시키고 트래픽을 분석하기 위해 쿠키를 사용합니다. See our privacy policy.