Mistral OCR 3 출시
·2025.12.17 09:00
Mistral이 필기체와 복잡한 표 인식 성능을 대폭 강화한 Mistral OCR 3를 출시했다.
Mistral OCR 3는 텍스트와 이미지 추출 성능을 극대화한 새로운 OCR 모델이다. 기존 Mistral OCR 2 대비 양식, 스캔 문서, 복잡한 표, 필기체 인식 분야에서 74% 높은 승률을 기록하며, 기존 기업용 및 AI 네이티브 OCR 솔루션을 능가하는 성능을 보여준다.
주요 업그레이드 사항은 다음과 같다:
- 필기체: 흘림체, 혼합 주석, 인쇄된 양식 위의 필기 인식 강화
- 양식(Forms): 인보이스, 영수증, 정부 문서 등의 복잡한 레이아웃 및 박스/라벨 감지 개선
- 스캔 및 복잡한 문서: 압축 노이즈, 왜곡, 저해상도(low DPI) 환경에서의 강건성 확보
- 복잡한 표: HTML 태그(
colspan,rowspan)를 활용해 병합된 셀과 계층 구조를 포함한 표 구조를 완벽하게 재구성
개발자는 API(mistral-ocr-2512)를 통해 모델을 통합할 수 있으며, Mistral AI Studio의 Document AI Playground를 통해 PDF와 이미지를 텍스트나 구조화된 JSON으로 즉시 변환할 수 있다. 비용은 1,000페이지당 $2로 매우 경제적이며, Batch-API 이용 시 50% 할인된 $1에 이용 가능하다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.