AI Briefing

Qwen35B 쾌속

Qwen3.5-35B-A3B Q8_K_XL Benchmark (Mac studio m2 ultra 64G)

·2026.04.17 11:14

핵심 내용

M2 Ultra 64GB에서 Qwen3.5-35B-A3B Q8_K_XL은 생성 63 t/s를 기록했다.

자세히 보기

Mac Studio M2 Ultra 64GB에서 Qwen3.5-35B-A3B Q8_K_XL을 돌린 벤치마크 결과다.

  • Prefill 10240: 1734 t/s
  • Prefill 16384: 1552 t/s
  • Generate 512: 63 t/s

실행 파라미터는 -ngl 99 -fa 1 -b 2048 -ub 2048 -ctk bf16 -ctv bf16 -mmp 0이며, 3회 반복 평균으로 집계했다.

긴 프롬프트 구간에서도 1,500~1,700 t/s대의 prefill을 유지했고, 생성 단계에서는 63 t/s를 기록해 로컬 대형 모델 추론 성능을 가늠할 수 있는 실측치가 됐다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.