AI Briefing

더 저렴하고, 더 뛰어나고, 더 빠르고, 더 강력하게

·2024.04.17 09:00

핵심 내용

Mistral AI가 효율성과 성능을 극대화한 새로운 오픈 모델 Mixtral 8x22B를 Apache 2.0 라이선스로 공개했다.

1 / 2

자세히 보기

Mistral AI의 최신 오픈 모델인 Mixtral 8x22B는 Sparse Mixture-of-Experts (SMoE) 구조를 채택했다. 전체 141B 파라미터 중 39B의 활성 파라미터만 사용하여 압도적인 비용 효율성을 제공한다.

주요 특징은 다음과 같다:

  • 영어, 프랑스어, 이탈리아어, 독일어, 스페인어 지원
  • 강력한 수학 및 코딩 능력
  • 네이티브 function calling 지원
  • 64K 토큰의 컨텍스트 윈도우 제공

이 모델은 Apache 2.0 라이선스로 배포되어 누구나 제한 없이 사용할 수 있다. 기존의 밀집형(dense) 70B 모델보다 빠르면서도, 다른 오픈 웨이트 모델들보다 뛰어난 성능을 보여준다.

벤치마크 결과, MMLU, HellaSwag, Arc Challenge 등 다양한 지표에서 우수한 성적을 거두었으며, 특히 다국어 능력 면에서 LLaMA 2 70B를 능가하는 성능을 입증했다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.