특허 특화 임베딩 모델 ParaEmbed 2.0 공개
XLSCOUT Unveils ParaEmbed 2.0: a Powerful Embedding Model Tailored for Patents and IP with Expert Support from Hugging Face
·2024.06.25 09:00
XLSCOUT가 Hugging Face와 협업하여 특허 및 지식재산권(IP) 분석에 최적화된 ParaEmbed 2.0을 출시했다.
XLSCOUT가 Hugging Face의 Expert Support Program을 통해 개발한 ParaEmbed 2.0을 공개했다. 이 모델은 복잡한 특허 문서의 전문 용어, 문맥, 관계를 정밀하게 분석하도록 설계된 도메인 특화 임베딩 모델이다.
전문가가 큐레이션한 고품질 특허 데이터를 활용해 미세 조정(Fine-tuning)을 진행했으며, 이전 버전 대비 정확도가 23% 향상되었다. 이를 통해 특허의 선행 기술(Prior art) 매핑 및 문맥 파악 능력이 크게 강화되었다.
주요 기술적 특징은 다음과 같다:
- 모델 기반: BGE-base-v1.5, Llama 2, Mixtral 8x7B 등 오픈소스 모델을 통합 및 미세 조정하여 구축했다.
- 고성능 추론: Hugging Face의 Inference Endpoints와 **Text Embedding Inference (TEI)**를 활용해 초당 약 2,700개의 임베딩을 처리하는 높은 처리량을 달성했다.
- 워크플로우 최적화: LLM 프롬프트 엔지니어링과 지시 데이터(Instruction data) 미세 조정을 통해 특허 초안 작성의 정확도와 법적 일관성을 높였다.
이 솔루션은 특허 무효화 검색, 신규성 검토, 특허 초안 작성 등 지식재산권(IP) 관련 업무의 효율성을 높이는 데 활용된다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.