추천VLM은 한국 공공기관 문서를 얼마나 잘 읽을까? KOLongDoc 벤치마크 공개
·2026.06.04 15:38
한국어 긴 공공기관 문서 이해 능력을 평가하기 위한 VLM 벤치마크 KOLongDoc이 공개되었다.
기존 한국어 VLM(Vision Language Model) 벤치마크는 OCR, VQA, 차트 이해 등에 집중되어 있어, 수십 페이지 분량의 고해상도 문서나 여러 페이지를 오가는 Multi-hop 추론, Long-context 이해 능력을 종합적으로 평가하기 어려웠습니다.
이러한 한계를 극복하기 위해 한국 공공기관 문서를 기반으로 한 오픈소스 벤치마크 KOLongDoc이 공개되었습니다.
주요 특징:
- 한국 공공기관 문서 기반 데이터셋 구성
- Multi-page / Multi-hop QA 평가 지원
- 고해상도 Long Document 이해 능력 측정
- 총 200개의 평가 문항 제공
KOLongDoc은 국내외 VLM 모델들이 실제 한국어 공공문서를 얼마나 정확하게 이해하고 추론할 수 있는지 검증하는 데 활용됩니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.