27B GGUF 공개
unsloth Qwen3.6-27B-GGUF
·2026.04.22 23:38
핵심 내용
Unsloth가 Qwen3.6-27B GGUF와 실행 가이드를 공개했다.
1 / 2
자세히 보기
Unsloth가 Qwen3.6-27B-GGUF와 실행·파인튜닝 가이드를 공개했다.
Qwen3.6는 에이전트 코딩과 thinking preservation을 강화한 27B 오픈웨이트 모델이며, 비전 인코더를 포함한 Causal LM 구조를 사용한다.
- 컨텍스트 길이: 기본 262,144 토큰, 최대 1,010,000 토큰까지 확장 가능
- 실행 지원: SGLang, vLLM, KTransformers, Hugging Face Transformers 예시 제공
- API 사용법: OpenAI 호환 Chat Completions 호출 예시 포함
- 툴 호출 개선: 중첩 객체 파싱을 개선해 tool calling 성공률을 높이도록 설계
- Unsloth Studio: Qwen3.6를 실행·파인튜닝하고, GGUF 양자화 벤치마크도 확인 가능
실서비스 배포용으로는 최신 프레임워크 버전을 쓰고, 생산 환경에서는 SGLang·KTransformers·vLLM 같은 전용 서빙 엔진을 권장한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.