업데이트된 Preparedness Framework
·2025.04.15 09:00
OpenAI가 프런티어 AI의 심각한 위험을 측정하고 방지하기 위한 업데이트된 Preparedness Framework를 공개했다.
OpenAI가 프런티어 AI 모델의 발전으로 발생할 수 있는 새로운 위험을 추적하고 대비하기 위한 Preparedness Framework를 업데이트했다. 이번 업데이트는 특정 위험에 대한 집중도를 높이고, 위험을 '충분히 최소화'하기 위한 요구 사항과 운영 지침을 강화하는 데 중점을 둔다.
위험 평가를 위해 High capability(기존 위험 증폭 가능성)와 Critical capability(전례 없는 새로운 위험 경로 도입 가능성)라는 두 가지 명확한 임계값을 도입했다. Critical capability 단계에 도달한 시스템은 개발 단계부터 위험을 최소화하기 위한 안전장치가 필수적이다.
역량 카테고리는 다음과 같이 구분된다:
- Tracked Categories: 생물학 및 화학, 사이버 보안, AI 자가 개선 등 이미 성숙한 평가 체계를 갖춘 분야.
- Research Categories: 장기 자율성(Long-range Autonomy), 샌드백킹(Sandbagging), 자율 복제 및 적응, 안전장치 무력화, 핵 및 방사능 등 신규 연구 분야.
내부 안전 리더들로 구성된 **Safety Advisory Group(SAG)**은 안전장치가 위험을 충분히 최소화하는지 검토하며, 배포 승인부터 추가 평가 요청까지 다양한 권고를 수행한다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.