AI Briefing

아동 안전 원칙

·2024.12.20 03:52

핵심 내용

Anthropic은 생성형 AI를 통한 아동 성착취 및 성적 피해를 방지하기 위해 'Safety by Design' 원칙에 따른 강력한 안전 조치를 시행한다.

자세히 보기

Anthropic은 생성형 AI 기술의 개발, 배포 및 유지 관리 과정에서 아동을 보호하기 위한 강력한 안전 조치를 도입한다. 이번 이니셔티브는 아동 성학대 방지 비영리 단체인 Thorn 및 All Tech Is Human과 협력하여 진행된다.

Anthropic은 Safety by Design 원칙을 준수하며, AI를 이용한 아동 성착취물(AIG-CSAM) 및 기타 성적 피해를 방지하기 위해 다음과 같은 단계별 조치를 이행한다.

개발(Develop) 단계:

  • CSAM 및 CSEM 위험이 있는 데이터의 학습 제외 및 유입 시 즉각적인 탐지·제거·보고
  • AIG-CSAM 대응을 위한 구조적이고 확장 가능한 레드팀(Red Teaming) 테스트 수행
  • 고객의 모델 오용 방지를 위한 엄격한 정책 수립

배포(Deploy) 단계:

  • 입력 및 출력 데이터 내 유해 콘텐츠 탐지 및 사용자 신고 기능 제공
  • 단계적 배포를 통한 초기 단계의 오용 모니터링 및 모델 카드 내 아동 안전 섹션 포함

유지 관리(Maintain) 단계:

  • NCMEC(미국 실종·착취 아동 센터)에 대한 체계적인 보고 및 AI 생성 조작 방지 도구 투자
  • OSINT(공개 출처 정보)를 활용하여 플랫폼 및 모델이 악용되는 방식을 지속적으로 파악

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.