Qwen3.6-Plus: 현실 세계 에이전트를 향해
Qwen3.6-Plus가 100만 토큰 컨텍스트와 강화된 agentic coding으로 출시됐다.
Qwen3.6-Plus는 Qwen3.5 출시 이후 나온 차세대 hosted model로, Alibaba Cloud Model Studio에서 바로 API로 사용할 수 있다. 기본 1M context window를 제공하며, 특히 agentic coding과 multimodal reasoning을 크게 강화한 것이 핵심이다.
코딩 에이전트 영역에서는 실제 개발 업무에 가까운 벤치마크에서 강한 성능을 보인다. SWE-bench Verified 78.8, SWE-bench Multilingual 73.8, SWE-bench Pro 56.6, Terminal-Bench 2.0 61.6을 기록했고, 복잡한 터미널 작업과 자동화 실행에서도 개선을 강조한다.
일반 에이전트와 tool usage에서도 성능 향상이 두드러진다. TAU3-Bench 70.7, DeepPlanning 41.5, MCPMark 48.2, MCP-Atlas 74.1, WideSearch 74.3 등에서 상위권을 보이며, 긴 호흡의 계획 수립과 도구 호출 능력을 함께 끌어올렸다고 설명한다.
기본 지식·추론 능력도 유지하거나 개선했다. MMLU-Pro 88.5, GPQA 90.4, LiveCodeBench v6 87.1, AIME26 95.3 같은 결과를 제시하며, 긴 컨텍스트 이해와 STEM 추론, 다국어 대응까지 폭넓게 커버한다고 강조한다.
멀티모달 쪽에서는 문서 이해, 시각 추론, 비디오 이해, visual agent까지 확장한다. OmniDocBench1.5 91.2, RealWorldQA 85.4, VideoMME 87.8, OSWorld-Verified 62.5 등이 대표적이며, 단순 인식보다 실제 업무형 시나리오에서 더 안정적으로 동작하는 점을 내세운다.
API 측면에서는 새로운 preserve_thinking 옵션이 추가됐다. 이전 턴의 thinking content를 유지해 다단계 agent 작업에서 일관성을 높이고 중복 추론을 줄일 수 있으며, 기본값은 false다.
- API 호환성: OpenAI specification 기반 chat completions / responses API, Anthropic 호환 인터페이스 지원
- 도구 연동: OpenClaw, Claude Code, Qwen Code, Kilo Code, Cline, OpenCode와 연동 가능
- 활용 포인트: 프론트엔드 개발, 3D 씬, 게임, 복잡한 repo-level 문제 해결, 멀티모달 업무 자동화
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.