AI Briefing

Spark-X2.5-4B-GGUF: 1M 컨텍스트 지원 4B 경량 LLM의 GGUF 배포판

XHToken/Spark-X2.5-4B-GGUF

·2026.09.11 02:36

Spark-X2.5-4B 모델의 BF16 GGUF 변환본으로, 로컬 환경에서 경량 추론을 가능하게 한다. 대화, 코드 작성, 번역, 추론 및 에이전트 워크플로우 등 범용 작업을 수행하도록 설계된 소형 언어 모델이다.

하이브리드 어텐션 아키텍처를 적용해 최대 1M 토큰의 네이티브 컨텍스트 길이를 지원하며, 200개 이상의 언어를 다룬다. thinking 모드 토글을 통해 응답 속도와 추론 깊이 사이에서 유연하게 조절할 수 있다.

llama.cpp, Ollama, LM Studio 등 주요 로컬 실행 환경과 호환되도록 최적화되었다. Apache 2.0 라이선스로 공개되어 상업적 이용 및 커스터마이징이 자유로우며, Q4_K_M 등 다양한 양자화 버전을 제공한다.

HuggingFace
HuggingFace 모델

XHToken/Spark-X2.5-4B-GGUF

원문에 등록된 설명이 없습니다.

text-generation

이 한국어 소개글은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 소개 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.