AI Briefing

Qwen3.6 상륙

New on Ollama: batiai/qwen3.6-35b — full Qwen 3.6 lineup with tools + thinking

·2026.04.18 23:17

핵심 내용

Qwen 3.6 35B-A3B를 Ollama용으로 양자화해 tools·thinking까지 지원한다.

자세히 보기

batiai/qwen3.6-35b가 Ollama에 올라왔다. Alibaba의 Qwen 3.6 35B-A3B BF16 가중치를 직접 양자화한 모델로, tools와 thinking을 지원한다.

제공 태그는 iq3, iq4, q3, q4, q6이며, 안내된 메모리 기준은 다음과 같다.

  • iq3/q3: 13GB, 최소 16GB RAM
  • iq4/q4: 18GB, 권장 24GB RAM
  • q6: 27GB, 36GB+ RAM 권장

벤치마크 수치도 함께 제시됐다. Qwen 3.5 35B-A3B 대비 SWE-bench Verified 73.4(+3.4), Terminal-Bench 2.0 51.5(+11.0), **QwenWebBench 1397(+43%)**로 향상됐다고 설명한다.

Gemma 4 31B와 비교해서도 SWE-bench Verified 73.4, SWE-bench Multilingual 67.2, SWE-bench Pro 49.5, Terminal-Bench 2.0 51.5, AIME26 92.7를 제시하며 우위를 강조한다.

실측 성능도 공개했다. **MacBook Pro M4 Max(128GB)**에서 iq3 45.9 t/s, iq4 46.5 t/s를 기록했고, iq3는 tool call JSON에서 실패, iq4는 통과했다고 적었다. **Mac mini M4(16GB)**에서는 iq3가 약 2~3 t/s 수준이며 iq4는 적합하지 않다고 밝혔다.

이 모델은 텍스트 전용으로 배포된다. 멀티모달 버전은 vision tower와 mmproj.gguf가 필요하지만, Ollama에서는 현재 텍스트 타워만 제공해 단일 파일, 더 작은 디스크·메모리 사용, 코드·RAG·툴콜 중심 워크로드에 맞춘 구성을 택했다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.