AI Briefing

Qwen 3.6 비교

Experience of Qwen 3.5-122b and 3.6

·2026.04.23 15:18

2 x RTX Pro 6000 환경에서 Qwen3.6-27B가 성능은 가장 좋았고, Qwen3.6-35B-A3B는 더 높은 tps를 보였다.

온프레미스 LLM을 2 x RTX Pro 6000, FP8, MTP 환경에서 운영하면서 Qwen3.5-122B, Qwen3.6-35B-A3B, Qwen3.6-27B를 순차적으로 적용한 결과, 체감 성능은 Qwen3.5-122B < Qwen3.6-35B-A3B < Qwen3.6-27B 순이었다.

속도와 컨텍스트 수치는 다음과 같이 제시됐다.

  • Qwen3.6-35B-A3B: 512k x 11, 280 tps
  • Qwen3.6-27B: 320k x 6, 110 tps

업무 요청 처리에서는 Qwen3.6-27B가 충분히 안정적이었고, 보고된 throughput은 Qwen3.6-35B-A3B가 더 높았다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.