AI Briefing

Unsloth가 벤치마크 1위

Qwen3.6 GGUF Benchmarks

·2026.04.18 01:17

핵심 내용

Qwen3.6-35B-A3B GGUF 벤치마크에서 Unsloth 양자화가 KLD 대비 용량 효율이 가장 좋다고 주장한다.

자세히 보기

Qwen3.6-35B-A3B GGUF의 KLD 성능 벤치마크를 공개했고, Unsloth quants가 디스크 용량 대비 KLD 기준으로 22개 중 21개에서 파레토 프런티어를 차지했다고 밝혔다.

GGUF 배포본은 Hugging Face의 unsloth/Qwen3.6-35B-A3B-GGUF에서 제공된다.

추가로 GGUF 재업로드 논란에 대해, 대부분의 경우는 내부 실수보다 llama.cpp 버그 수정이나 상위 모델의 템플릿 개선 같은 외부 원인 때문이라고 설명했다.

사례로는 다음을 들었다.

  • Gemma 4는 총 4번 재업로드됐고, 그중 3번은 여러 llama.cpp 수정 반영 때문이었다.
  • 마지막 1번은 Google의 공식 chat template 개선 반영이었다.
  • MiniMax 2.7 NaNs 조사에서는 Bartowski quants의 38% (10/26), Unsloth quants의 **22% (5/23)**에서 NaN이 발견됐다고 적었다.
  • Unsloth는 해당 문제의 수정본을 이미 반영했다고 밝혔다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.