Mistral OCR
·2025.03.06 09:00
Mistral이 복잡한 문서의 텍스트, 표, 수식 등을 정확하게 추출하는 새로운 Mistral OCR API를 출시했다.
전 세계 조직 데이터의 약 **90%**는 문서 형태로 저장되어 있다. Mistral은 이러한 비정형 데이터를 효과적으로 활용하기 위해 문서의 모든 요소를 정교하게 이해하는 Mistral OCR을 공개했다.
Mistral OCR은 이미지와 PDF를 입력받아 텍스트, 미디어, 표, 수식 등을 순서에 맞춰 텍스트와 이미지로 교차 구성된 형태로 추출한다. 특히 LaTeX 형식을 포함한 복잡한 수식과 차트, 그래프가 포함된 과학 논문 같은 문서를 깊이 있게 이해하는 데 탁월하다.
이 모델은 슬라이드나 복잡한 PDF를 입력으로 사용하는 RAG 시스템과 결합할 때 최적의 성능을 발휘한다. 주요 특징은 다음과 같다:
- 복잡한 문서 요소에 대한 최첨단 이해 능력
- 네이티브 멀티링구얼 및 멀티모달 지원
- 업계 최고 수준의 벤치마크 및 빠른 처리 속도
- Doc-as-prompt 방식의 구조화된 출력 지원
- 민감한 정보를 다루는 조직을 위한 셀프 호스팅 옵션 제공
Mistral OCR은 현재 Le Chat의 기본 문서 이해 모델로 적용되었으며, 개발자 플랫폼인 la Plateforme를 통해 mistral-ocr-latest API로 즉시 사용할 수 있다. 가격은 1달러당 약 1,000페이지이며, 배치 추론(batch inference)을 사용하면 비용을 약 2배 더 효율적으로 사용할 수 있다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.