AI Briefing

SafetyKit, OpenAI의 최첨단 모델로 리스크 에이전트 규모 확장

·2025.09.09 19:00

SafetyKit이 GPT-5 등 OpenAI의 최첨단 모델을 활용해 멀티모달 리스크 에이전트의 정확도와 처리 용량을 대폭 강화했다.

SafetyKit은 마켓플레이스, 결제 플랫폼, 핀테크 기업을 위해 텍스트, 이미지, 금융 거래 등 다양한 영역에서 사기 및 금지 활동을 탐지하는 멀티모달 AI 에이전트를 구축한다. 최근 모델의 추론 및 멀티모달 이해 능력이 향상됨에 따라 리스크 관리와 컴플라이언스 운영의 새로운 기준을 제시하고 있다.

SafetyKit의 에이전트는 GPT-5, GPT-4.1, Deep Research, **Computer Using Agent(CUA)**를 활용하여 고객 콘텐츠의 100%를 검토하며, 자체 평가 기준 95% 이상의 정확도를 기록하고 있다. 일일 처리 토큰량은 6개월 전 2억 개에서 현재 160억 개로 급증했다.

각 리스크 카테고리에 최적화된 모델을 매칭하여 운영한다:

  • GPT-5: 텍스트, 이미지, UI를 아우르는 멀티모달 추론을 통해 숨겨진 리스크 탐지
  • GPT-4.1: 상세한 콘텐츠 정책 준수 및 대규모 모더레이션 워크플로우 관리
  • Reinforcement fine-tuning(RFT): 복잡한 안전 정책에 대한 재현율과 정밀도 향상
  • Deep Research: 판매자 리뷰 및 검증을 위한 실시간 온라인 조사 통합
  • Computer Using Agent(CUA): 복잡한 정책 업무 자동화로 수동 검토 의존도 감소

예를 들어, Scam Detection 에이전트는 이미지에 포함된 QR 코드나 전화번호를 분석하며, Policy Disclosure 에이전트는 법적 고지 사항이나 지역별 규정 준수 여부를 GPT-5로 정밀하게 평가한다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.