NuExtract3: 문서 추출 및 변환 모델
numind/NuExtract3 · Hugging Face
·2026.05.25 18:18
문서 이해와 구조화된 정보 추출에 특화된 4B 규모의 비전-언어 모델 NuExtract3가 공개되었습니다.
NuExtract3는 문서 이해를 위해 설계된 4B 규모의 통합 비전-언어(Vision-Language) 추론 모델입니다.
주요 기능은 다음과 같습니다:
- 구조화된 정보 추출: 텍스트나 이미지를 입력받아 JSON 템플릿에 맞춰 JSON 형식으로 출력합니다.
- Markdown 변환: 이미지 및 텍스트를 고품질의 Markdown 형식으로 변환합니다.
- 멀티모달 및 다국어 지원: 텍스트와 이미지를 결합한 입력이 가능하며, 다양한 언어의 문서를 처리할 수 있습니다.
- 추론 모드 제공: 추론(Reasoning) 및 비추론(Non-reasoning) 모드를 선택할 수 있습니다.
영수증, 송장, 계약서, 표 등 다양한 형태의 문서를 대상으로 OCR, RAG 전처리, 데이터 추출 파이프라인 구축에 최적화되어 있습니다. 현재 GGUF, NVFP4, MLX, VLLM 등 다양한 양자화 및 추론 프레임워크를 지원합니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.