3개 모델 합쳤다
Qwen3.6-35B-A3B-Holo3-Qwopus
·2026.04.23 08:02
핵심 내용
Qwen3.6-35B-A3B에 Qwopus·Holo3를 섞은 병합 모델과 벤치마크가 공개됐다.
자세히 보기
Qwen/Qwen3.6-35B-A3B, samuelcardillo/Qwopus-MoE-35B-A3B, Hcompany/Holo3-35B-A3B를 합친 Qwen3.6-35B-A3B-Holo3-Qwopus가 공개됐다.
배포본은 bf16, qx64-hi-mlx, mxfp4-mlx로 제공되며, 추론·양자화별 성능 수치도 함께 제시됐다.
- bf16: perplexity 4.217 ± 0.027, peak memory 76.15 GB, 1642 tok/s
- qx64-hi: perplexity 4.231 ± 0.028, peak memory 36.83 GB, 1573 tok/s
- mxfp4: perplexity 4.522 ± 0.030, peak memory 25.33 GB, 1609 tok/s
Instruct 모드에서는 mxfp8 기준으로 arc 0.608, arc/e 0.770, boolq 0.897, hswag 0.761 등으로 측정됐다. 동일 계열의 다른 변형과 비교한 component metrics도 함께 공개돼, Holo3 Instruct가 Qwopus Instruct와 Qwen Instruct보다 전반적으로 높은 점수를 보였다.
Thinking mode에서는 qx64-hi가 arc/e 0.476, boolq 0.708, hswag 0.693를 기록했고, qx64는 peak memory 30.69 GB, 1366 tok/s, perplexity 4.702 ± 0.032로 제시됐다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.