개인정보 필터링 모델 Shield 82M
🛡️ Shield 82M: A PII stripping/filtering model 🛡️
·2026.04.25 19:21
핵심 내용
다국어 텍스트에서 개인정보(PII)를 탐지하고 제거하는 82M 규모의 오픈소스 모델이 공개되었습니다.
자세히 보기
distilroberta-base를 미세 조정(Fine-tuning)하여 개발된 Shield 82M은 텍스트 내의 다양한 **개인정보(PII, Personally Identifiable Information)**를 식별하고 필터링하는 모델입니다.
주요 특징은 다음과 같습니다:
- 다국어 지원: 영어 및 프랑스어 등 다양한 언어의 텍스트에서 개인정보를 탐지할 수 있습니다.
- 다양한 항목 탐지: 이름, 이메일, 전화번호, 주소 등 다양한 유형의 개인정보를 처리합니다.
- 높은 정확도: 테스트 결과 약 96%의 정확도를 기록했습니다.
- 경량 모델: 82M 파라미터 규모로 설계되어 효율적인 추론이 가능합니다.
해당 모델은 오픈소스로 공개되어 Hugging Face에서 확인할 수 있습니다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.