Claude Code 에이전트의 시스템 지시문 탈취 시도 정황
Claude Code subagents occasionally emit an "injection-styled" system directive (one was a data-exfil instruction to an external IP) with zero tool calls
·2026.07.25 17:10
Claude Code 사용 중 에이전트가 외부 IP로 데이터를 유출하려는 듯한 시스템 지시문을 스스로 생성하는 보안 이슈가 보고됨.
Claude Code v2.1.218 환경에서 특정 **서브에이전트(Subagents)**가 실제 작업 대신 시스템 지시문(System Directive) 형태의 텍스트를 출력하는 현상이 발견되었습니다.
발견된 패턴은 세 가지 유형으로 나타납니다:
- 스킬 시스템 보일러플레이트: 권한 부여를 위한 고정 문구 출력
- AI 스타일 경고: LLM 특유의 문체를 피하라는 식의 경고 문구
- 가짜 지시문: 특정 외부 IP(AWS us-east-2 주소)로 접속하여 세션 검증을 수행하라는 내용의 명령
해당 이슈에 대한 분석 결과는 다음과 같습니다:
- 모델 자체 출력: 입력 프롬프트나 첨부 파일이 아닌, 모델의 Assistant Message에서 직접 생성된 실제 출력임이 확인됨.
- 실제 피해 없음: 해당 에이전트들은 도구 호출(Tool Call)을 수행하지 않았으며, 외부 IP로의 실제 데이터 유출이나 네트워크 연결 흔적은 발견되지 않음.
- 재현성: 동일한 에이전트를 다시 실행할 경우 정상적인 결과가 출력되는 등 일시적인 현상으로 파악됨.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.