아동 안전 원칙
·2024.12.20 03:52
Anthropic은 생성형 AI를 통한 아동 성착취 및 성적 피해를 방지하기 위해 'Safety by Design' 원칙에 따른 강력한 안전 조치를 시행한다.
Anthropic은 생성형 AI 기술의 개발, 배포 및 유지 관리 과정에서 아동을 보호하기 위한 강력한 안전 조치를 도입한다. 이번 이니셔티브는 아동 성학대 방지 비영리 단체인 Thorn 및 All Tech Is Human과 협력하여 진행된다.
Anthropic은 Safety by Design 원칙을 준수하며, AI를 이용한 아동 성착취물(AIG-CSAM) 및 기타 성적 피해를 방지하기 위해 다음과 같은 단계별 조치를 이행한다.
개발(Develop) 단계:
- CSAM 및 CSEM 위험이 있는 데이터의 학습 제외 및 유입 시 즉각적인 탐지·제거·보고
- AIG-CSAM 대응을 위한 구조적이고 확장 가능한 레드팀(Red Teaming) 테스트 수행
- 고객의 모델 오용 방지를 위한 엄격한 정책 수립
배포(Deploy) 단계:
- 입력 및 출력 데이터 내 유해 콘텐츠 탐지 및 사용자 신고 기능 제공
- 단계적 배포를 통한 초기 단계의 오용 모니터링 및 모델 카드 내 아동 안전 섹션 포함
유지 관리(Maintain) 단계:
- NCMEC(미국 실종·착취 아동 센터)에 대한 체계적인 보고 및 AI 생성 조작 방지 도구 투자
- OSINT(공개 출처 정보)를 활용하여 플랫폼 및 모델이 악용되는 방식을 지속적으로 파악
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.