AI Briefing

Claude Mythos Preview의 사이버보안 능력 평가

·2026.04.09 05:34

Anthropic의 Claude Mythos Preview가 제로데이 취약점을 자율적으로 발견하고 익스플로잇하는 강력한 보안 능력을 입증했다.

Anthropic의 Claude Mythos Preview가 일반 목적 언어 모델임에도 불구하고 사이버 보안 분야에서 압도적인 취약점 발견 및 익스플로잇 능력을 보여주었습니다. Anthropic은 이를 계기로 핵심 소프트웨어 보안을 강화하기 위한 Project Glasswing을 출범했습니다.

Mythos Preview는 모든 주요 운영체제와 웹 브라우저에서 제로데이 취약점을 자율적으로 식별하고 공격 코드를 작성할 수 있습니다. 특히 OpenBSD의 27년 된 버그나 FFmpeg의 16년 된 취약점 등 수십 년간 발견되지 않았던 보안 결함을 찾아내는 데 성공했습니다.

기존 모델인 Opus 4.6이 Firefox JavaScript 엔진 취약점 익스플로잇 시도 중 단 2회 성공했던 것과 달리, Mythos Preview는 동일 실험에서 181회 성공하며 차원이 다른 성능을 입증했습니다. 이는 별도의 보안 훈련 없이도 코드 추론 및 자율성이라는 일반적 역량의 향상을 통해 자연스럽게 발현된 결과입니다.

주요 보안 성과 및 사례:

  • FreeBSD NFS RCE: 17년 된 취약점을 인간의 개입 없이 자율적으로 발견하고 루트 권한을 획득하는 익스플로잇 작성.
  • Linux 커널 권한 상승: KASLR 우회 및 힙 스프레이 등을 체이닝하여 완전한 루트 권한 획득.
  • 웹 브라우저 공격: JIT 힙 스프레이 및 샌드박스 탈출을 통해 OS 커널에 직접 쓰기가 가능한 공격 구성.

Anthropic은 모델의 위험성을 고려하여 이를 일반에 공개하지 않고, 한정된 산업 파트너 및 오픈소스 개발자에게만 제한적으로 공개하여 방어 체계를 먼저 강화하는 전략을 취하고 있습니다. 모든 발견된 취약점은 전문 보안 업체의 검증을 거쳐 책임 있게 공개(Coordinated Vulnerability Disclosure)됩니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.