AI Briefing

Anthropic, AI 모델의 전술 정보 타겟팅 및 재래식 무기 개발 능력 평가 결과 공개

·2026.09.10 09:00

핵심 내용

Anthropic이 AI 모델의 전술 정보 타겟팅 및 드론 무기 개발 능력을 평가한 결과, 최상위 모델이 인간 전문가 수준 이상의 성능을 보임.

1 / 5

자세히 보기

Anthropic의 Frontier Red Team이 AI 모델의 전술 정보 타겟팅 및 재래식 무기 개발 능력을 평가한 보고서를 공개했다. 이번 평가는 AI가 군사 및 정보 작업에 악용될 수 있는 위험성을 측정하고, 이를 차단하기 위한 분류기 도입의 근거를 마련하기 위해 진행됐다.

전술 정보 타겟팅 및 지리 위치 추정

AI 모델은 합성 SNS 데이터를 활용해 개인을 식별하고 연결하는 타겟팅 작업에서 높은 정확도를 보였다. 특히 Mythos Preview 모델은 이론적 상한과 가장 가까운 성능을 기록했으며, 인간 전문가가 2.5시간 소요하는 작업을 평균 11분 만에 완료했다. 지리 위치 추정 평가에서는 Flickr 이미지 기반 테스트에서 Mythos Preview가 평균 오차 37km를 기록해 인간 최상위권(GeoGuessr Champion 151km)을 능가했다. 텍스트 기반 위치 추정에서도 일부 모델이 1km 이내 정확히 위치를 파악하는 등 프라이버시 침해 가능성이 확인됐다.

드론 유도 및 무기 개발 능력

AI 모델은 GPS나 레이저 유도 없이 카메라와 IMU 데이터만으로 드론을 제어하는 FPV 말단 유도 및 폭탄 투하 코드 작성 능력을 입증했다. Opus 5 모델은 정지 차량 타격률 80%, 이동 차량 타격률 47%를 기록하며 가장 높은 성능을 보였다. 또한, GPS 재밍이나 스푸핑 공격 상황에서도 IMU dead-reckoning 기술을 활용해 15~20m 오차로 목적지에 도달하는 내비게이션 코드를 작성했다. 이는 AI가 정밀 무기 개발의 소프트웨어적 병목을 제거하고 접근성을 높일 수 있음을 시사한다.

시사점 및 대응 방안

평가 결과, 폐쇄형과 오픈 웨이트 모델 모두 위협 행위자의 인적 식별 및 무기 하위 시스템 설계 지원이 가능한 것으로 나타났다. Anthropic은 이러한 오남용을 방지하기 위해 무기 개발을 차단하는 분류기 도입 등 안전 조치를 필수화해야 한다고 강조했다. 또한, 민주주의 국가들은 AI 시대에 맞춰 기존 법과 규제를 업데이트하고, 방어자 관점에서의 AI 활용 가능성을 연구해야 한다고 제언했다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.