AI Briefing

27B GGUF 공개

unsloth Qwen3.6-27B-GGUF

·2026.04.22 23:38

핵심 내용

Unsloth가 Qwen3.6-27B GGUF와 실행 가이드를 공개했다.

1 / 2

자세히 보기

Unsloth가 Qwen3.6-27B-GGUF와 실행·파인튜닝 가이드를 공개했다.

Qwen3.6는 에이전트 코딩과 thinking preservation을 강화한 27B 오픈웨이트 모델이며, 비전 인코더를 포함한 Causal LM 구조를 사용한다.

  • 컨텍스트 길이: 기본 262,144 토큰, 최대 1,010,000 토큰까지 확장 가능
  • 실행 지원: SGLang, vLLM, KTransformers, Hugging Face Transformers 예시 제공
  • API 사용법: OpenAI 호환 Chat Completions 호출 예시 포함
  • 툴 호출 개선: 중첩 객체 파싱을 개선해 tool calling 성공률을 높이도록 설계
  • Unsloth Studio: Qwen3.6를 실행·파인튜닝하고, GGUF 양자화 벤치마크도 확인 가능

실서비스 배포용으로는 최신 프레임워크 버전을 쓰고, 생산 환경에서는 SGLang·KTransformers·vLLM 같은 전용 서빙 엔진을 권장한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.