AI Briefing

Qwen 3.6 비교

Experience of Qwen 3.5-122b and 3.6

·2026.04.23 15:18

핵심 내용

2 x RTX Pro 6000 환경에서 Qwen3.6-27B가 성능은 가장 좋았고, Qwen3.6-35B-A3B는 더 높은 tps를 보였다.

자세히 보기

온프레미스 LLM을 2 x RTX Pro 6000, FP8, MTP 환경에서 운영하면서 Qwen3.5-122B, Qwen3.6-35B-A3B, Qwen3.6-27B를 순차적으로 적용한 결과, 체감 성능은 Qwen3.5-122B < Qwen3.6-35B-A3B < Qwen3.6-27B 순이었다.

속도와 컨텍스트 수치는 다음과 같이 제시됐다.

  • Qwen3.6-35B-A3B: 512k x 11, 280 tps
  • Qwen3.6-27B: 320k x 6, 110 tps

업무 요청 처리에서는 Qwen3.6-27B가 충분히 안정적이었고, 보고된 throughput은 Qwen3.6-35B-A3B가 더 높았다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.