영국 AI 안전 정상회의
·2024.08.06 04:55
Anthropic이 AI의 급격한 발전에 따른 위험을 관리하기 위해 **AI 안전 수준(ASL)** 기반의 **책임 있는 스케일링 정책(RSP)**을 발표했다.
AI 기술은 컴퓨팅 자원이 매년 8배씩 성장함에 따라 매우 빠르게 발전하고 있다. 이러한 급격한 진보는 AI가 생물 무기 제조와 같은 위험한 기술을 언제 습득할지 예측하기 어렵게 만든다.
Anthropic은 이러한 불확실성에 대응하기 위해 **책임 있는 스케일링 정책(RSP)**을 도입했다. 이 정책은 AI 안전 수준(ASL) 체계와 정기적인 위험 테스트라는 두 가지 핵심 축으로 운영된다.
**ASL(AI Safety Levels)**의 주요 단계는 다음과 같다:
- ASL-1: 위험이 거의 없는 특수 목적 AI 단계.
- ASL-2: 현재 단계로, 모델 카드 작성 및 외부 레드팀 활동 등 최선의 보안 관행을 적용한다.
- ASL-3: CBRN(화학·생물·방사능·핵) 분야에서 치명적인 오용이 가능한 단계. 강력한 보안과 함께 위험 정보를 생성하지 못하도록 하는 기술적 돌파구가 요구된다.
- ASL-4: AI가 인간의 통제를 벗어나거나 심각한 글로벌 보안 위협이 되는 단계. 모델 내부의 작동 원리에 대한 정밀한 이해가 전제되어야 한다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.