Escha-W2 (Hugging Face 저장소)
·2026.07.30 09:00
Qwen3.6-35B-A3B 모델을 2비트로 양자화하여 저사양 GPU에서도 구동 가능한 Escha-W2를 공개했다.
256개의 전문가(Experts)로 구성된 Mixture-of-Experts 모델인 Qwen3.6-35B-A3B를 2-bit로 양자화한 Escha-W2가 출시되었다.
이 모델은 OpenAI 호환 HTTP API를 통해 로컬 환경에서 즉시 서빙할 수 있도록 필요한 모든 패키지를 포함하고 있다.
주요 특징은 다음과 같다:
- 디스크 용량: 12.3 GB
- 구동 환경: 단일 24 GB GPU 또는 16 GB GPU에서도 실행 가능
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.