ASL-3 보호 조치 활성화
·2025.07.24 03:03
Anthropic이 Claude Opus 4 출시와 함께 CBRN 위험 방지를 위한 ASL-3 보안 및 배포 표준을 선제적으로 적용했다.
Anthropic은 Claude Opus 4 출시와 함께 자사의 책임 있는 스케일링 정책(RSP)에 명시된 AI Safety Level 3 (ASL-3) 배포 및 보안 표준을 활성화했다.
이번 조치는 모델의 가중치(Weights) 탈취를 방지하기 위한 보안 강화와, 화학·생물·방사능·핵(CBRN) 무기 개발 및 획득에 모델이 악용되는 것을 막기 위한 배포 조치를 포함한다.
Anthropic은 이번 적용을 예방적이고 잠정적인 조치로 정의했다. Claude Opus 4가 ASL-3 적용이 필수적인 '능력 임계값(Capability Threshold)'을 확실히 통과했는지 아직 확정되지는 않았으나, 모델의 CBRN 관련 지식과 능력이 지속적으로 향상됨에 따라 위험 가능성을 완전히 배제할 수 없다고 판단했기 때문이다.
ASL-3 표준의 핵심 내용은 다음과 같다:
- 보안 제어: 정교한 비국가 행위자의 공격으로부터 모델 가중치를 보호하기 위한 강화된 내부 보안 조치.
- 배포 조치: CBRN 관련 위험을 제한하기 위해 설계된 정밀한 배포 관리.
Anthropic은 향후 지속적인 평가를 통해 Claude Opus 4가 관련 임계값을 넘지 않은 것으로 판명될 경우, ASL-3 보호 조치를 조정하거나 제거할 수 있다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.