AI Briefing

OpenAI, Astra의 사이버 보안 능력 'Critical' 등급 지정 및 강화된 안전장치 공개

·2026.09.01 22:00

핵심 내용

OpenAI가 Astra의 자율적 제로데이 취약점 발견 능력을 인정해 Critical 등급으로 지정하고, 제한적 접근과 강화된 안전장치를 적용한다.

자세히 보기

OpenAI는 자사의 Preparedness Framework에 따라 Astra 모델이 Critical 사이버 보안 능력 임계값을 충족했다고 발표했다. 이는 Astra가 사람의 개입 없이도 잘 보호된 시스템에서 알려지지 않은 보안 결함을 찾아내고 이를 악용할 수 있음을 의미한다. Astra는 이 등급으로 지정된 첫 번째 모델이다.

능력 평가 및 벤치마크 결과

Astra는 이전 모델인 GPT-5.6 Sol보다 토큰 효율성과 취약점 식별 능력에서 현저히 향상되었다. ExploitBench에서 Astra는 알려진 취약점을 이용한 익스플로잇 개발 능력으로 **100%**의 점수를 기록했다.

데이터 오염 우려로 인해 OpenAI는 2026년 6월부터 8월 사이에 공개된 20개의 고위험 V8 취약점을 포함한 내부 벤치마크를 구축했다. 이 테스트에서 Astra는 GPT-5.6 Sol보다 훨씬 적은 출력 토큰으로 임의 코드 실행률을 달성했으며, 익스플로잇 체인 과정에서 2개의 제로데이 취약점을 발견하고 활용했다. 해당 취약점은 현재 유지보수자에게 공개 절차를 진행 중이다.

전문가 주도 평가에서는 강화된 브라우저와 OS 환경에서 샌드박스를 탈출하여 호스트에서 명령을 실행하는 완전한 브라우저 침해 체인을 구축했다. 또한 비특권 사용자에서 루트 권한으로의 로컬 권한 상승 체인을 만들기 위해 OS의 여러 취약점을 결합했다.

안전 조치 및 배포 계획

개발 및 배포 과정에서 사이버 악용과 무단 모델 동작에 대한 보호 장치를 강화하기 위해 일부 개발 일정을 지연했다. Hugging Face 사건에는 Astra가 관여하지 않았으나, 해당 사건에서 얻은 교훈을 반영해 안전 접근 방식을 업데이트했다. Astra에는 유해한 사이버 요청을 더 확실하게 거부하도록 학습된 모델, 추가적인 악용 방지 보호 장치, 무단 활동을 차단할 수 있는 모니터링 시스템이 적용되었다.

Astra는 곧 출시될 예정이지만, 가장 진보된 사이버 보안 기능은 제한적으로 제공된다. 초기에는 Daybreak Blue를 통해 방어적 사용을 위해 확장될 테스트 그룹에게만 고급 사이버 보안 작업 접근 권한이 부여된다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.