AI Briefing

Unsloth Dynamic 3.0 GGUFs

·2026.08.20 03:36

핵심 내용

Unsloth가 Qwen3.8-27B용 Dynamic v3.0 양자화 모델을 출시하며 정확도 향상을 입증했다.

자세히 보기

Unsloth가 Dynamic v3.0 양자화 기술을 공개하고 Qwen3.8-27B 모델을 지원하기 시작했다. 동일한 용량에서 기존 제공자 대비 10% 이상 높은 top-1% 정확도를 달성했으며, llama.cpp 및 Unsloth Desktop 등 주요 추론 엔진과 호환된다.

이번 업데이트에서는 다변화된 소스에서 수집된 고품질 imatrix 캘리브레이션 데이터셋을 활용하여 에이전틱 코딩, 채팅, 다국어 성능을 최적화했다. QAT/QAD 없이 순수 PTQ(Post-Training Quantization) 방식으로 수행되어 과적합 문제를 최소화했으며, 커뮤니티가 테스트할 수 있도록 imatrix 파일을 공개했다.

주요 기술적 개선 사항으로는 다음과 같다.

  • Divergence-300 @32 지표 도입: 단일 토큰 예측이 아닌 32토큰 시퀀스 비교를 통해 실제 추론 경로의 유사성을 평가한다.
  • MTP 모듈 제거: 8.37GB 이하의 소형 양자화 모델에서 MTP 모듈을 제거해 약 500MB의 디스크 공간을 절약했다.
  • 초소형 모델 지원: 6.2GB 크기의 UD-IQ1_S 양자화 모델이 원본 대비 89% 축소된 상태에서 약 72%의 top-1% 정확도를 유지한다.

5일 만에 510만 건 이상의 다운로드를 기록했으며, KL Divergence 벤치마크에서도 경쟁사 대비 우위를 점하고 있다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.