AI Briefing

업데이트된 책임 있는 스케일링 정책(Responsible Scaling Policy) 발표

·2024.10.16 05:44

Anthropic이 AI의 치명적 위험을 관리하기 위한 **책임 있는 스케일링 정책(RSP)**을 업데이트했다.

Anthropic이 프론티어 AI 시스템의 치명적 위험을 완화하기 위한 리스크 거버넌스 프레임워크인 **책임 있는 스케일링 정책(RSP)**을 업데이트했다. 이번 업데이트는 AI 기술 발전에 맞춰 더 유연하고 세밀한 위험 평가 및 관리 방식을 도입하는 것을 골자로 한다.

핵심 원칙은 잠재적 위험에 비례하여 보호 조치를 강화하는 **비례적 보호(Proportional Protection)**이다. 이를 위해 모델의 역량에 따라 안전 조치 수준을 단계별로 적용하는 **AI 안전 수준 표준(ASL Standards)**을 활용한다.

현재 모든 모델은 업계 최고 수준인 ASL-2 표준을 따르고 있으며, 다음과 같은 특정 **역량 임계값(Capability Thresholds)**에 도달할 경우 더 높은 수준의 안전 조치를 요구한다.

  • 자율적 AI 연구 및 개발: 모델이 인간의 전문 지식 없이 복잡한 AI 연구를 수행할 수 있는 경우 (ASL-4 이상 요구)
  • CBRN(화학, 생물, 방사능, 핵) 무기: 모델이 무기 제조나 배포를 실질적으로 도울 수 있는 경우 (ASL-3 요구)

이번 정책은 기존의 사용 정책(Usage Policy) 및 사회적 영향 연구를 보완하며, 급격한 AI 발전 속도에 맞춰 안전 장치를 선제적으로 마련하는 데 목적이 있다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.