AI Briefing

GPT-5.5, 사이버 평가 선두

AI Security Institute: GPT-5.5 "may be the strongest model we have tested" for cyber exploits, including Mythos

·2026.05.01 01:30

AISI 평가에서 GPT-5.5가 Mythos Preview를 넘는 사이버 성능을 나타냈다.

AISI가 GPT-5.5의 초기 checkpoint를 평가한 결과, Anthropic의 Claude Mythos Preview와 비슷한 수준의 사이버 능력에 도달한 것으로 나타났다.

  • 95개의 narrow cyber task를 4개 난이도로 돌렸고, basic suite는 2026년 2월부터 사실상 포화 상태였다.
  • Expert-level task에서 GPT-5.5는 50M token budget 기준 71.4% ±8.0를 기록해 Mythos Preview 68.6% ±8.7, GPT-5.4 52.4% ±9.8, Opus 4.7 48.6% ±10.0를 앞섰다.
  • rust_vm 과제에서는 기본 ReAct scaffold와 Bash/Python 도구만 쓴 Kali Linux 컨테이너에서 GPT-5.5가 10분 22초$1.73의 API 비용으로 stripped Rust VM과 bytecode authenticator를 역공학해 통과했다. AISI의 전문가 플레이테스터는 같은 과제를 약 12시간에 해결했다.
  • cyber range인 The Last Ones(TLO) 에서는 100M token budget 기준 10회 중 2회 끝까지 도달해, Mythos Preview 다음으로 완주한 모델이 됐다. 반면 Cooling Tower 는 아직 어떤 모델도 풀지 못했다.

AISI는 현재 range가 실제 방어자, 탐지 도구, 경보 패널티를 충분히 반영하지 못한다고 덧붙였고, 별도 red-teaming에서는 GPT-5.5 사이버 방어막을 무력화하는 universal jailbreak 도 찾아냈다. OpenAI는 이후 방어 스택을 업데이트했다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.