NuExtract3: 4B 규모의 문서 추출용 VLM 출시
Finetuned Qwen3.5-4B: NuExtract3 released, open-weight 4B VLM for Markdown, OCR and structured extraction
·2026.05.22 19:57
Numind가 문서의 Markdown 변환 및 구조화된 데이터 추출에 특화된 4B VLM인 NuExtract3를 공개했다.
Numind가 Apache-2.0 라이선스로 공개한 NuExtract3는 Qwen3.5-4B를 기반으로 한 4B 규모의 오픈 웨이트 시각 언어 모델(VLM)이다. 복잡한 문서에서 정보를 추출하는 작업을 실용화하기 위해 설계되었다.
주요 기능은 다음과 같다:
- 문서 이미지를 Markdown으로 변환
- JSON 템플릿을 활용한 구조화된 데이터 추출
- 표(Table), 양식(Form), 레이아웃이 복잡한 페이지 처리
- 텍스트와 시각적 입력을 모두 지원하는 OCR 기능
8xH100 노드에서 3일간 학습되어 긴 컨텍스트 처리에 강점이 있으며, 4GB VRAM만으로도 구동이 가능하다. Safetensors, GGUF, MLX 등 다양한 포맷과 양자화 버전을 제공하여 vLLM, llama.cpp 등에서 쉽게 사용할 수 있다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.