Mistral Moderation API
·2024.11.07 09:00
Mistral AI가 9개 카테고리의 콘텐츠를 분류할 수 있는 LLM 기반 Moderation API를 출시했다.
Mistral AI가 자사 서비스인 Le Chat에서 사용하는 것과 동일한 콘텐츠 Moderation API를 출시했다. 사용자는 이 도구를 각자의 애플리케이션과 안전 표준에 맞춰 맞춤형으로 활용할 수 있다.
이 모델은 텍스트 입력을 9가지 카테고리로 분류하는 LLM 분류기로, 두 가지 엔드포인트를 제공한다.
- Raw text: 일반 텍스트 분류용
- Conversational content: 대화 맥락 내 마지막 메시지를 분류하는 대화형 콘텐츠용
해당 모델은 한국어를 포함한 11개 언어를 지원하는 네이티브 다국어 모델이다. 특히 부적절한 조언이나 개인정보(PII) 노출과 같은 모델 생성 유해성을 방지하는 데 중점을 두었다.
성능은 내부 테스트 세트를 통해 AUC PR 지표로 검증되었으며, Mistral AI는 앞으로도 연구 커뮤니티와 협력하여 안전 기술 발전에 기여할 계획이다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.