AI Briefing
추천

Anthropic CEO Dario Amodei, AI 속도 조절을 위한 3단계 계획 제안

·2026.09.12 23:10

핵심 내용

Dario Amodei, AI 개발 속도 조절을 위해 내장 평가자 도입, 민주적 조정, 글로벌 조정을 골자로 한 3단계 계획 제안

자세히 보기

Dario Amodei는 AI 개발을 균형 잡힌 속도로 유지하여 안전성을 확보하고 지정학적 딜레마에 대응하기 위한 'Pacing the Frontier' 3단계 계획을 제안했습니다. 이 계획은 모델 훈련이나 기술 진보를 중단하는 것이 아니라, 정렬(alignment) 및 안전 조치에 충분한 시간을 확보하고 제3자 평가자가 이를 확인하도록 하는 것을 목표로 합니다.

1단계로 Anthropic은 제3자 평가팀에게 내부 직원과 유사한 접근 권한을 부여하여 안전 관행 준수 여부를 검증하는 '내장 평가자(Embedded Evaluators)' 제도를 일방적으로 도입할 것을 약속했습니다. 이는 은행 산업의 규제 감독관 제도와 유사한 선례가 있습니다.

2단계는 민주주의 국가의 프론티어 AI 기업들이 공통 안전 표준과 unchecked AI 진보 속도에 대한 제한을 수립하기 위해 협력하는 '민주적 조정(Democratic Coordination)'입니다. 이는 정부 지원이나 반독점 규제 유예가 필요할 수 있으며, 모델의 능력에 따라 정렬 속성 인증을 요구하는 체크포인트 방식을 포함할 수 있습니다.

3단계는 민주주의 국가와 권위주의 국가 간의 '글로벌 조정(Global Coordination)'을 시도하는 것입니다. Amodei는 생물무기 사용 금지(Level 1)는 실현 가능성이 높으나, 모델 출시 전 위험 테스트 의무화(Level 2)는 검증의 어려움이 있고, 재귀적 자기 개선(RSI) 속도 제한(Level 3)은 SALT 조약처럼 가능하지만 어려울 것이며, 전면적인 속도 조절이나 중단(Level 4)은 감시 회피 인센티브 때문에 실현 가능성이 낮다고 분석했습니다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.