업데이트된 책임 있는 스케일링 정책(Responsible Scaling Policy) 발표
·2024.10.16 05:44
핵심 내용
Anthropic이 AI의 치명적 위험을 관리하기 위한 **책임 있는 스케일링 정책(RSP)**을 업데이트했다.
자세히 보기
Anthropic이 프론티어 AI 시스템의 치명적 위험을 완화하기 위한 리스크 거버넌스 프레임워크인 **책임 있는 스케일링 정책(RSP)**을 업데이트했다. 이번 업데이트는 AI 기술 발전에 맞춰 더 유연하고 세밀한 위험 평가 및 관리 방식을 도입하는 것을 골자로 한다.
핵심 원칙은 잠재적 위험에 비례하여 보호 조치를 강화하는 **비례적 보호(Proportional Protection)**이다. 이를 위해 모델의 역량에 따라 안전 조치 수준을 단계별로 적용하는 **AI 안전 수준 표준(ASL Standards)**을 활용한다.
현재 모든 모델은 업계 최고 수준인 ASL-2 표준을 따르고 있으며, 다음과 같은 특정 **역량 임계값(Capability Thresholds)**에 도달할 경우 더 높은 수준의 안전 조치를 요구한다.
- 자율적 AI 연구 및 개발: 모델이 인간의 전문 지식 없이 복잡한 AI 연구를 수행할 수 있는 경우 (ASL-4 이상 요구)
- CBRN(화학, 생물, 방사능, 핵) 무기: 모델이 무기 제조나 배포를 실질적으로 도울 수 있는 경우 (ASL-3 요구)
이번 정책은 기존의 사용 정책(Usage Policy) 및 사회적 영향 연구를 보완하며, 급격한 AI 발전 속도에 맞춰 안전 장치를 선제적으로 마련하는 데 목적이 있다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.