3개 모델 합쳤다
Qwen3.6-35B-A3B-Holo3-Qwopus
·2026.04.23 08:02
Qwen3.6-35B-A3B에 Qwopus·Holo3를 섞은 병합 모델과 벤치마크가 공개됐다.
Qwen/Qwen3.6-35B-A3B, samuelcardillo/Qwopus-MoE-35B-A3B, Hcompany/Holo3-35B-A3B를 합친 Qwen3.6-35B-A3B-Holo3-Qwopus가 공개됐다.
배포본은 bf16, qx64-hi-mlx, mxfp4-mlx로 제공되며, 추론·양자화별 성능 수치도 함께 제시됐다.
- bf16: perplexity 4.217 ± 0.027, peak memory 76.15 GB, 1642 tok/s
- qx64-hi: perplexity 4.231 ± 0.028, peak memory 36.83 GB, 1573 tok/s
- mxfp4: perplexity 4.522 ± 0.030, peak memory 25.33 GB, 1609 tok/s
Instruct 모드에서는 mxfp8 기준으로 arc 0.608, arc/e 0.770, boolq 0.897, hswag 0.761 등으로 측정됐다. 동일 계열의 다른 변형과 비교한 component metrics도 함께 공개돼, Holo3 Instruct가 Qwopus Instruct와 Qwen Instruct보다 전반적으로 높은 점수를 보였다.
Thinking mode에서는 qx64-hi가 arc/e 0.476, boolq 0.708, hswag 0.693를 기록했고, qx64는 peak memory 30.69 GB, 1366 tok/s, perplexity 4.702 ± 0.032로 제시됐다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.