Claude Mythos Preview의 사이버보안 능력 평가
Anthropic의 Claude Mythos Preview가 제로데이 취약점을 자율적으로 발견하고 익스플로잇하는 강력한 보안 능력을 입증했다.
Anthropic의 Claude Mythos Preview가 일반 목적 언어 모델임에도 불구하고 사이버 보안 분야에서 압도적인 취약점 발견 및 익스플로잇 능력을 보여주었습니다. Anthropic은 이를 계기로 핵심 소프트웨어 보안을 강화하기 위한 Project Glasswing을 출범했습니다.
Mythos Preview는 모든 주요 운영체제와 웹 브라우저에서 제로데이 취약점을 자율적으로 식별하고 공격 코드를 작성할 수 있습니다. 특히 OpenBSD의 27년 된 버그나 FFmpeg의 16년 된 취약점 등 수십 년간 발견되지 않았던 보안 결함을 찾아내는 데 성공했습니다.
기존 모델인 Opus 4.6이 Firefox JavaScript 엔진 취약점 익스플로잇 시도 중 단 2회 성공했던 것과 달리, Mythos Preview는 동일 실험에서 181회 성공하며 차원이 다른 성능을 입증했습니다. 이는 별도의 보안 훈련 없이도 코드 추론 및 자율성이라는 일반적 역량의 향상을 통해 자연스럽게 발현된 결과입니다.
주요 보안 성과 및 사례:
- FreeBSD NFS RCE: 17년 된 취약점을 인간의 개입 없이 자율적으로 발견하고 루트 권한을 획득하는 익스플로잇 작성.
- Linux 커널 권한 상승: KASLR 우회 및 힙 스프레이 등을 체이닝하여 완전한 루트 권한 획득.
- 웹 브라우저 공격: JIT 힙 스프레이 및 샌드박스 탈출을 통해 OS 커널에 직접 쓰기가 가능한 공격 구성.
Anthropic은 모델의 위험성을 고려하여 이를 일반에 공개하지 않고, 한정된 산업 파트너 및 오픈소스 개발자에게만 제한적으로 공개하여 방어 체계를 먼저 강화하는 전략을 취하고 있습니다. 모든 발견된 취약점은 전문 보안 업체의 검증을 거쳐 책임 있게 공개(Coordinated Vulnerability Disclosure)됩니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.