NuExtract3: 문서 추출 및 변환 모델
numind/NuExtract3 · Hugging Face
·2026.05.25 18:18
핵심 내용
문서 이해와 구조화된 정보 추출에 특화된 4B 규모의 비전-언어 모델 NuExtract3가 공개되었습니다.
자세히 보기
NuExtract3는 문서 이해를 위해 설계된 4B 규모의 통합 비전-언어(Vision-Language) 추론 모델입니다.
주요 기능은 다음과 같습니다:
- 구조화된 정보 추출: 텍스트나 이미지를 입력받아 JSON 템플릿에 맞춰 JSON 형식으로 출력합니다.
- Markdown 변환: 이미지 및 텍스트를 고품질의 Markdown 형식으로 변환합니다.
- 멀티모달 및 다국어 지원: 텍스트와 이미지를 결합한 입력이 가능하며, 다양한 언어의 문서를 처리할 수 있습니다.
- 추론 모드 제공: 추론(Reasoning) 및 비추론(Non-reasoning) 모드를 선택할 수 있습니다.
영수증, 송장, 계약서, 표 등 다양한 형태의 문서를 대상으로 OCR, RAG 전처리, 데이터 추출 파이프라인 구축에 최적화되어 있습니다. 현재 GGUF, NVFP4, MLX, VLLM 등 다양한 양자화 및 추론 프레임워크를 지원합니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.