AI Briefing

영국 AI 안전 정상회의

·2024.08.06 04:55

핵심 내용

Anthropic이 AI의 급격한 발전에 따른 위험을 관리하기 위해 **AI 안전 수준(ASL)** 기반의 **책임 있는 스케일링 정책(RSP)**을 발표했다.

자세히 보기

AI 기술은 컴퓨팅 자원이 매년 8배씩 성장함에 따라 매우 빠르게 발전하고 있다. 이러한 급격한 진보는 AI가 생물 무기 제조와 같은 위험한 기술을 언제 습득할지 예측하기 어렵게 만든다.

Anthropic은 이러한 불확실성에 대응하기 위해 **책임 있는 스케일링 정책(RSP)**을 도입했다. 이 정책은 AI 안전 수준(ASL) 체계와 정기적인 위험 테스트라는 두 가지 핵심 축으로 운영된다.

**ASL(AI Safety Levels)**의 주요 단계는 다음과 같다:

  • ASL-1: 위험이 거의 없는 특수 목적 AI 단계.
  • ASL-2: 현재 단계로, 모델 카드 작성 및 외부 레드팀 활동 등 최선의 보안 관행을 적용한다.
  • ASL-3: CBRN(화학·생물·방사능·핵) 분야에서 치명적인 오용이 가능한 단계. 강력한 보안과 함께 위험 정보를 생성하지 못하도록 하는 기술적 돌파구가 요구된다.
  • ASL-4: AI가 인간의 통제를 벗어나거나 심각한 글로벌 보안 위협이 되는 단계. 모델 내부의 작동 원리에 대한 정밀한 이해가 전제되어야 한다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.