Mythos 사이버 쇼크
UK government's AISI: "Our results show Claude Mythos is a step up over previous frontier models."
핵심 내용
Claude Mythos Preview가 이전 frontier 모델보다 사이버 능력에서 한 단계 앞섰다.
자세히 보기
AISI가 Anthropic의 Claude Mythos Preview를 사이버 평가한 결과, 기존 frontier 모델보다 한 단계 높은 성능을 보였다.
CTF에서는 기술적 비전문가·견습 수준 과제부터 전문가 수준 과제까지 성능이 개선됐고, 전문가급 과제에서는 73% 성공률을 기록했다.
더 복잡한 multi-step cyber-attack simulation인 **The Last Ones(TLO)**에서는 전체 32단계 중 평균 22단계를 수행했고, 10회 시도 중 3회는 시작부터 끝까지 완주했다. 비교 대상인 Claude Opus 4.6은 평균 16단계에 그쳤다.
다만 운영기술(OT) 중심의 Cooling Tower 범레인지는 완료하지 못했고, IT 구간에서 막혔다. AISI는 방어 장비와 활성 대응이 없는 환경이라 실제로 잘 방어된 시스템에 대한 공격 능력은 단정할 수 없다고 설명했다.
결론적으로, Mythos Preview는 네트워크 접근을 얻은 상태에서 약한 보안의 기업 시스템을 자율적으로 공격할 수 있는 수준에 도달했으며, 모델 성능은 더 많은 inference compute와 더 큰 token budget에서도 계속 확장될 가능성이 있다고 봤다. 이에 따라 조직들은 패치 관리, 접근 통제, 보안 설정, 로깅 같은 기본 방어를 강화해야 한다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.