AI Briefing

연구자들 “Fable 5 논란은 탈옥이 아니라 ‘fix this code’에서 시작됐다”

·2026.06.17 09:48

Anthropic 모델의 접근 제한이 탈옥이 아닌 단순 코드 수정 요청에서 비롯되었다는 보안 전문가들의 주장과 논란이 제기됨.

미국 정부가 국가 안보를 이유로 Anthropic의 Fable 5Mythos 5 모델에 대한 수출 통제 지침을 내리며 접근을 제한했으나, 이에 대해 보안 전문가들이 반론을 제기했습니다.

Luta Security의 CEO Katie Moussouris는 해당 모델들이 '탈옥(Jailbreak)' 공격을 받은 것이 아니라, 연구자들이 취약점이 포함된 코드를 입력한 뒤 **“fix this code”**라고 요청했을 때 모델이 응답하면서 문제가 시작되었다고 주장했습니다. 이는 보안 검토 및 패치 검증을 위한 정상적인 'find, fix, and test loop' 과정이었다는 설명입니다.

주요 쟁점은 다음과 같습니다:

  • 수출 통제 배경: 미국 정부는 모델이 취약점을 이용한 공격에 악용될 수 있다는 안보 우려로 접근을 제한했으며, Anthropic은 규정 준수를 위해 모든 고객의 접근을 차단했습니다.
  • 보안 전문가들의 반론: 100명 이상의 보안 리더들은 이러한 제한이 공격자보다 **방어자(Defender)**에게 더 큰 피해를 준다고 경고합니다. AI를 활용한 버그 발견과 패치 검증 역량이 제한될 경우 사이버 보안 생태계 전반이 약화될 수 있다는 입장입니다.
  • 기술적 쟁점: 연구자들은 모델이 보안 가드레일을 우회한 것이 아니라, 단순한 코드 수정 요청에 응답하는 과정에서 보안 취약점과 테스트 스크립트를 생성한 것이라고 강조합니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.