AI Briefing

Mistral 3 소개

·2025.12.02 09:00

Mistral이 Apache 2.0 라이선스로 공개되는 차세대 모델 Mistral 3 시리즈를 발표했다.

Mistral이 차세대 모델인 Mistral 3를 발표했다. 이번 시리즈는 14B, 8B, 3B 규모의 소형 밀집(dense) 모델인 Ministral과, 총 675B(활성 41B) 파라미터를 가진 희소 혼합 전문가(MoE) 모델인 Mistral Large 3로 구성된다. 모든 모델은 Apache 2.0 라이선스로 공개되어 개발자 커뮤니티의 자유로운 활용을 지원한다.

Mistral Large 3는 NVIDIA H200 GPU 3,000개를 활용해 처음부터 학습되었으며, 일반 프롬프트에서 시장의 최고 수준 오픈 웨이트 모델들과 대등한 성능을 보여준다. 특히 이미지 이해 능력과 영어 및 중국어를 제외한 다국어 대화에서 업계 최고 수준의 성능을 자랑한다.

모델의 접근성과 효율성을 높이기 위해 NVIDIA, vLLM, Red Hat과 협력하여 최적화를 진행했다. NVFP4 포맷 체크포인트를 통해 Blackwell NVL72 시스템이나 8×A100/H100 노드에서 효율적으로 구동할 수 있으며, TensorRT-LLMSGLang을 통한 저정밀도 실행도 지원한다.

  • Mistral Large 3는 LMArena 리더보드 OSS 비추론(non-reasoning) 카테고리에서 2위를 기록했다.
  • 향후 추론(reasoning) 버전 모델도 출시될 예정이다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.