AI Briefing

미국 선거 대응 준비 현황

·2024.10.09 03:29

Anthropic은 2024년 미국 선거를 앞두고 AI 오남용을 방지하기 위한 정책 강화와 탐지 기술 고도화 등 다각적인 안전 조치를 시행한다.

Anthropic은 2024년 미국 선거에서 생성형 AI 도구가 오남용되는 것을 방지하고 사용자에게 정확한 정보를 제공하기 위해 다각적인 대응책을 마련했다.

먼저 **사용 정책(Usage Policy)**을 업데이트하여 정치적 캠페인 및 로비 활동을 금지하고, 선거법이나 후보자에 대한 허위 정보 생성을 차단한다. 또한 Claude는 텍스트 출력만 지원하여 딥페이크와 같은 이미지, 오디오, 비디오 생성 위험을 원천적으로 제거했다.

오남용을 탐지하기 위해 다음과 같은 강력한 집행 체계를 운영한다:

  • 정책 준수를 위한 자동화 시스템 및 인간 검토 병행
  • claude.ai 프롬프트 수정 및 API 사용 사례 감사
  • AWS 및 **Google Cloud Platform(GCP)**과의 협력을 통한 오남용 탐지 및 완화

지속적인 레드팀(Red-teaming) 활동과 **정책 취약성 테스트(PVT)**를 통해 모델의 편향성과 허위 정보 대응 능력을 검증한다. 특히 정치적 중립성을 유지하고 유해한 질의에 대한 거부 능력을 평가하는 자동화된 평가 시스템을 구축하여 모델을 지속적으로 개선하고 있다.

사용자에게는 정확한 정보를 제공하기 위해 선거 관련 질의 시 TurboVote와 같은 신뢰할 수 있는 외부 리소스로 연결하는 팝업을 제공하며, 모델의 지식 컷오프(knowledge cutoff) 날짜를 명시하여 정보의 한계를 명확히 알린다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.