AI Briefing

MiMo-V2.5 GGUF 공개

MiMo-V2.5-GGUF (preview available)

·2026.04.29 14:24

핵심 내용

XiaomiMiMo의 MiMo-V2.5를 텍스트 전용 GGUF로 양자화해 공개했다.

1 / 2

자세히 보기

309B 파라미터의 mimo2 아키텍처인 XiaomiMiMo/MiMo-V2.5를 텍스트 전용 GGUF로 양자화했다.

이미지·오디오 입력은 포함되지 않았고, 멀티모달 지원은 llama.cpp upstream에 반영되기 전까지 사용할 수 없다. attention_value_scale 지원을 위해서는 최신 llama.cpp 메인보다 PR #22493 브랜치 빌드가 권장된다.

MoE 구조에서 비중이 큰 FFN 텐서를 중심으로 혼합 양자화를 적용해, 전체 용량을 줄이면서 품질 저하를 억제하도록 설계했다.

  • Q8_0: 305.68 GiB, PPL 5.135221, base 대비 +0.1229%
  • Q5_K_M: 212.42 GiB, PPL 5.142293, +0.2608%
  • Q4_K_M: 176.70 GiB, PPL 5.204791, +1.4793%
  • IQ4_XS: 136.78 GiB, PPL 5.270911, +2.7685%
  • IQ3_S: 105.33 GiB, PPL 5.547074, +8.1529%

KLD와 PPL 곡선을 함께 공개해 각 양자화의 용량-품질 트레이드오프를 비교할 수 있게 했다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.