Qwen3.8-27B-GGUF: 클라우드 API 없이 로컬에서 Qwen3.8-27B 구동
unsloth/Qwen3.8-27B-GGUF
·2026.08.20 09:00
프로젝트 소개
Qwen3.8-27B 모델을 GGUF 포맷으로 변환해 배포한 저장소다. llama.cpp, Ollama, LM Studio 등 로컬 추론 엔진에서 바로 사용할 수 있다. Apache-2.0 라이선스로 공개되어 있어 상업적 활용도 가능하다.

UD-Q4_K_M, Q8_0, BF16 등 다양한 양자화 레벨의 파일이 준비되어 있다. 하드웨어 사양에 맞춰 메모리 사용량과 품질을 조절할 수 있다. mmproj 파일도 포함되어 있어 멀티모달 입력 처리가 지원된다.
채팅 템플릿에 reasoning effort 설정이 내장되어 있다. xhigh, medium, low 세 가지 수준으로 추론 깊이를 조절할 수 있다. 도구 호출(tool calling) 형식도 지원해 에이전트 기반 워크플로우에 적합하다.
클라우드 API 의존 없이 로컬에서 LLM을 구동해야 하는 개발자에게 유용하다. 프라이버시 민감한 작업이나 오프라인 환경에서 텍스트 생성, 코드 작성, 질의응답을 처리할 때 사용할 수 있다.
HuggingFace 모델
unsloth/Qwen3.8-27B-GGUF
원문에 등록된 설명이 없습니다.
이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.