NuExtract3: 문서 추출용 4B VLM 공개
NuExtract3 released: open-weight 4B VLM for Markdown, OCR and structured extraction (self-hostable)
·2026.05.25 22:14
Qwen3.5-4B 기반의 문서 데이터 추출 및 Markdown 변환 특화 VLM인 NuExtract3가 공개되었습니다.
Numind에서 공개한 NuExtract3는 Qwen3.5-4B를 기반으로 하는 4B 파라미터 규모의 오픈 웨이트 VLM입니다. 복잡한 문서(PDF, 스크린샷, 양식, 테이블, 영수증 등)에서 정보를 추출하고 이를 Markdown이나 JSON 형식으로 변환하는 데 최적화되어 있습니다.
주요 특징은 다음과 같습니다:
- 문서 구조 이해: 테이블, 양식, 레이아웃이 복잡한 페이지를 효과적으로 처리합니다.
- 다양한 입력 지원: 텍스트와 시각적 문서 입력을 모두 처리할 수 있습니다.
- 효율적인 로컬 배포: 4GB 미만의 VRAM으로도 구동 가능하며, GGUF, MLX, GPTQ, FP8 등 다양한 양자화 형식을 지원합니다.
- 긴 컨텍스트 처리: 8xH100 노드에서 3일간 학습되어 긴 문서 처리 능력이 향상되었습니다.
vLLM, SGLang, llama.cpp 등 주요 추론 엔진을 지원하며, Apache-2.0 라이선스에 따라 자유롭게 사용할 수 있습니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.