AI Briefing

Qwen 2배 가속

DFlash Doubles the T/S Gen Speed of Qwen3.5 27B (BF16) on Mac M5 Max

·2026.04.15 11:46

핵심 내용

oMLX 0.3.5 RC1의 DFlash로 Mac M5 Max에서 Qwen3.5 27B가 9→22 T/S로 빨라졌다.

자세히 보기

oMLX 0.3.5 RC1의 DFlash 지원을 켜자, Mac M5 Max 128GB에서 Qwen3.5 27B (BF16) 생성 속도가 9 T/S → 22 T/S로 뛰었다는 초기 테스트 결과다.

  • 메인 모델: Jackrong/MLX-Qwopus3.5-27B-v3-bf16
  • 드래프트 모델: z-lab/Qwen3.5-27B-DFlash
  • 환경: M5 Max 128GB
  • DFlash 저장소와 oMLX RC1 링크를 함께 공유하며, 로컬 배포에서의 체감 속도 개선 가능성을 강조했다.

작성자는 Qwen3.5 27B가 크기 대비 성능이 좋아서 속도만 해결되면 더 높은 quant나 full weights로도 실사용 가능성이 커진다고 봤다.

다만 아직 OpenCode 같은 다른 harness에서는 테스트하지 않았고, 이번 수치는 초기 실험값이다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.