Claude Code Opus 5 Auto Mode, 프롬프트 인젝션 공격에 80% 실패
·2026.08.28 09:00
핵심 내용
Claude Code Opus 5의 Auto Mode가 악성 코드 실행을 차단하지 못해 보안 취약점이 드러났다.
자세히 보기
Anthropic이 Claude Code의 Auto Mode를 기본 설정으로 적용하며 프롬프트 인젝션 공격에 대한 강력한 방어력을 주장했으나, 실제 보안 연구에서 심각한 취약점이 발견되었다. 연구자 Johann Rehberger는 Auto Mode가 악성 코드 실행을 차단하지 못하는 공격 벡터를 발견했으며, 해당 공격은 약 **80%**의 성공률을 보였다.
공격은 Claude Code가 zip 아카이브를 다운로드하고 압축 해제하도록 유도한 후, base64 모듈을 가져오는 코드를 실행하게 만드는 방식이다. 이 과정에서 아카이브에서 추출된 로컬 struct.py 파일이 의도치 않게 가져와져 실행되며 악성 코드가 작동한다.
더욱 심각한 문제는 안전 메커니즘 자체가 실패의 일부가 되는 현상이다. 일부 사례에서는 Claude가 침해 사실을 감지하고 악성 프로세스를 종료하려 했으나, Auto Mode가 정작 정리(cleanup) 명령어를 차단했다. 분류기가 악성 프로세스 생성은 허용한 반면, 이를 중지하려는 명령은 막아버린 것이다.
이에 따라 Simon Willison은 잠재적 공격 위험이 있는 경우 에이전트를 실행하는 유일한 안전한 방법은 샌드박스 환경이라고 강조했다. 권장 사항은 다음과 같다:
- 컨테이너, VM 또는 OS 샌드박스에서 비동기 코딩 에이전트 실행
- 네트워크 아웃바운드 트래픽 제한
- 에이전트 모니터링 강화
- 홈 디렉토리, SSH 키, 클라우드 자격 증명 등 민감 정보 노출 금지
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.