AI Briefing

차세대 핵심 사이버 역량에 대응하기

·2026.08.08 00:20

핵심 내용

OpenAI가 차기 모델 Astra의 핵심 사이버 역량 가능성을 배제할 수 없다며 보안 통제를 강화했다.

자세히 보기

OpenAI는 차기 모델 Astra에 대한 최근 내부 평가에서 에이전트형 코딩과 사이버보안 역량이 크게 향상됐다고 밝혔다. 전문가 평가를 종합한 결과, Astra가 자사의 Preparedness Framework에서 정의한 Critical 사이버 역량에 도달했을 가능성을 배제할 수 없다고 판단했다.

Preparedness Framework에서 Critical 기준은 인간의 개입 없이 다양한 보안 강화형 실제 핵심 시스템에서 모든 심각도 수준의 기능성 제로데이 취약점을 식별·개발하거나, 높은 수준의 공격 목표만 주어졌을 때 보안 강화형 표적을 대상으로 새로운 사이버공격 전략을 처음부터 끝까지 고안·실행하는 능력이다.

OpenAI는 평가를 계속 진행하는 한편, 이 수준의 역량에 맞춰 안전장치를 강화하고 있다.

  • 고성능 모델과 관련 활동에 격리된 테스트 환경, 제한된 네트워크·도구 접근, 모델 가중치 암호화, 강화된 모니터링·탐지, 샌드박스 실행을 적용한다.
  • 강화된 보안 통제 요건을 충족하지 못한 Astra 관련 내부 활동은 일시 중단한다.
  • Astra의 모든 에이전트 애플리케이션과 학습·평가 과정에 위험 행동 및 정렬 실패를 감시하는 범용 모니터링을 적용한다.
  • 모니터는 모델의 Chain of Thought를 평가하고 고위험 활동이 감지되면 보안 검토와 중단 절차를 실행한다.
  • 관련 정부 기관과 일부 AI 안전 조직, 제3자 테스트 파트너와 협력해 고위험 평가를 안전하게 진행한다.

OpenAI는 Astra가 Hugging Face 침해에 관여한 모델은 아니라고 덧붙였다. 또한 고도화된 사이버 역량을 갖춘 모델이 공격보다 먼저 취약점을 찾아내는 방어 목적에 활용돼야 한다며, 정부·안전 연구기관·시민사회와 협력해 책임 있는 배포를 추진하겠다고 밝혔다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.