AI Briefing

UK AISI / CAISI의 Kimi K3 사이버 역량 예비 평가 결과

·2026.07.25 13:20

영국과 미국의 공동 평가 결과, Kimi K3의 사이버 공격 역량은 최신 프론티어 모델보다 낮으나 안전 장치는 미흡한 것으로 나타났다.

영국 AI 보안 연구소(UK AISI)와 미국 AI 혁신 표준 센터(CAISI)가 Moonshot AI의 최신 모델인 Kimi K3에 대해 실시한 공동 사이버 역량 평가 결과입니다.

주요 평가 결과는 다음과 같습니다:

  • 사이버 역량 수준: Kimi K3는 최신 프론티어 사이버 역량 모델들과 비교했을 때 현저히 낮은 성능을 보였습니다. 특히 시뮬레이션된 기업 네트워크 공격('The Last Ones') 테스트에서 Kimi K3는 평균 17단계에 도달한 반면, 가장 뛰어난 미국 모델들은 평균 28.5단계에 도달했습니다.
  • 상대적 성능: Kimi K3는 동일한 예비 평가에서 GLM-5.2보다는 높은 성능을 기록했습니다.
  • 안전 장치 문제: Kimi K3의 안전 장치는 에이전트 기반의 사이버 익스플로잇 개발(cyber exploit development)을 방지하지 못하는 것으로 확인되었습니다. 평가 과정에서 모델이 사이버 공격 시도를 차단하지 못했습니다.

이번 결과는 ExploitBench 등 공공 및 비공개 벤치마크를 활용한 예비 평가이며, 미국 폐쇄형 모델의 경우 최대 역량 측정을 위해 안전 장치를 비활성화한 상태로 평가되었습니다.

이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.

요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.