Anthropic, 최강 모델의 탐지 결과는 공개하되 모델 자체는 제공하지 않는다
·2026.08.24 09:00
핵심 내용
Anthropic이 Claude Mythos 5의 보안 스캔 결과를 파트너에게 제공하며 모델 접근은 제한한다.
자세히 보기
Anthropic은 최상위 사이버보안 모델인 Claude Mythos 5의 접근 방식을 변경했다. 사용자가 모델에 직접 프롬프트를 입력하는 대신, Claude Security 및 파트너 제품 내에서 코드 스캔을 수행해 결과물만 제공한다.
기업 고객은 저장소를 스캔하여 CWE 카테고리, 심각도, 신뢰도 및 수정 제안이 포함된 결과를 일반 토큰 사용량으로 청구받는다. 모든 패치는 사람이 검토하고 승인해야 적용되는 구조로, 악용 가능성을 원천 차단했다.
또한 Anthropic은 오픈소스 보안 강화를 위해 3,500만 달러 상당의 크레딧을 Defender Advantage Fund에 투입한다. 이 기금은 널리 쓰이는 프로젝트의 취약점 패치, 스캔 자동화, 그리고 공격 클래스 전체를 차단하는 설계 연구에 사용된다.
이러한 조치는 유럽의 사이버 복원력 법(CRA) 의무 이행 시점과 맞물려 주목받는다. 최근 Anthropic의 모델이 설정 오류로 인해 실제 조직에 도달한 사례가 있었기 때문에, 결과물만 전달하는 방식이 안전성 확보에 유리하다고 판단했다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.