AI Briefing

아동 안전 원칙

·2024.12.20 03:52

Anthropic은 생성형 AI를 통한 아동 성착취 및 성적 피해를 방지하기 위해 'Safety by Design' 원칙에 따른 강력한 안전 조치를 시행한다.

Anthropic은 생성형 AI 기술의 개발, 배포 및 유지 관리 과정에서 아동을 보호하기 위한 강력한 안전 조치를 도입한다. 이번 이니셔티브는 아동 성학대 방지 비영리 단체인 ThornAll Tech Is Human과 협력하여 진행된다.

Anthropic은 Safety by Design 원칙을 준수하며, AI를 이용한 아동 성착취물(AIG-CSAM) 및 기타 성적 피해를 방지하기 위해 다음과 같은 단계별 조치를 이행한다.

개발(Develop) 단계:

  • CSAMCSEM 위험이 있는 데이터의 학습 제외 및 유입 시 즉각적인 탐지·제거·보고
  • AIG-CSAM 대응을 위한 구조적이고 확장 가능한 레드팀(Red Teaming) 테스트 수행
  • 고객의 모델 오용 방지를 위한 엄격한 정책 수립

배포(Deploy) 단계:

  • 입력 및 출력 데이터 내 유해 콘텐츠 탐지 및 사용자 신고 기능 제공
  • 단계적 배포를 통한 초기 단계의 오용 모니터링 및 모델 카드 내 아동 안전 섹션 포함

유지 관리(Maintain) 단계:

  • NCMEC(미국 실종·착취 아동 센터)에 대한 체계적인 보고 및 AI 생성 조작 방지 도구 투자
  • OSINT(공개 출처 정보)를 활용하여 플랫폼 및 모델이 악용되는 방식을 지속적으로 파악

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.