AI Briefing

선거 안전장치 업데이트

·2026.04.28 17:59

Anthropic은 선거 기간 중 Claude가 정치적 편향 없이 정확하고 중립적인 정보를 제공하도록 안전장치를 강화했다.

Anthropic은 미국 중간선거를 비롯한 전 세계 주요 선거를 앞두고, Claude가 정치적 정보를 정확하고 중립적으로 제공할 수 있도록 안전장치를 강화했다.

정치적 편향성을 방지하기 위해 Claude의 헌법(Constitution) 원칙에 따라 다양한 정치적 관점을 동일한 깊이와 분석적 엄격함으로 다루도록 모델을 훈련했다. 이는 캐릭터 훈련과 시스템 프롬프트를 통해 구현되며, 모델 출시 전 정치적 스펙트럼 전반에 걸친 공정성을 평가한다. 평가 결과, Opus 4.7은 95%, Sonnet 4.6은 96%의 높은 점수를 기록했다.

또한, 선거 관련 오용을 막기 위해 다음과 같은 방어 체계를 운영한다:

  • 사용 정책(Usage Policy): 기만적 캠페인, 가짜 콘텐츠 생성, 유권자 부정 및 투표 관련 허위 정보 유포를 엄격히 금지한다.
  • 탐지 및 집행: 자동화된 **분류기(Classifiers)**와 전담 위협 인텔리전스 팀을 통해 조작된 선거 개입 시도를 실시간으로 탐지하고 차단한다.

최근 실시한 600개의 프롬프트 테스트 결과, Opus 4.7은 선거 관련 정책 준수 및 유해 요청 거절에서 100%의 적절한 대응률을 보였으며, Sonnet 4.6은 99.8%를 기록하며 강력한 방어 능력을 입증했다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.