Cloudflare, Managed Defense용 다중 AI 에이전트 보안 하네스 베타 공개
핵심 내용
Cloudflare가 Managed Defense에 인간 통제 하의 다중 AI 에이전트 보안 하네스를 베타 출시했다.
자세히 보기
Cloudflare가 Cloudflare Managed Defense 내에서 다중 AI 에이전트 보안 운영 하네스를 베타 출시했다. 이는 동시 경보로 인해 인간 분석가가 압도되는 '경보 역설'을 해결하기 위한 조치다. 시스템은 증거 수집과 컨텍스트 집계를 자동화해 분석가가 데이터 수집 대신 해결에 집중할 수 있도록 지원한다. 심층 분석에는 OpenAI Daybreak Defense Network 및 Anthropic 파트너십의 GPT-5.6 Cyber와 Mythos 모델을 활용하며, 초기 점수 매기기 및 분류에는 Cloudflare의 오픈소스 결정 모델인 Clef를 사용한다.
아키텍처: 정찰 우선, 추론 나중
이 하네스는 결정론적 데이터 수집과 AI 추론을 분리해 단일 에이전트 시스템의 환각 및 범위 이탈 문제를 피한다. 모델 분석이 시작되기 전에 애플리케이션 코드가 고정된 정찰 워크플로우를 실행해 고객 ID, 감지 이력, 트래픽 기준선을 수집한다. 이는 버전 관리가 가능한 재현 가능한 증거 스냅샷을 생성하며, AI 결과의 차이가 데이터 검색 불일치가 아닌 해석 차이에서 비롯되도록 보장한다.
분류 및 전문가 에이전트
노이즈를 줄이기 위해 Workers AI에서 실행되는 Clef가 오탐 가능성이 높은 경보를 빠르게 필터링해 심층 분석을 생략한다. 검토가 필요한 경보에 대해서는 코디네이터 에이전트가 네 개의 전문가 에이전트를 병렬로 실행한다:
- 트래픽 분석: 요청 동작 및 강제 적용 결과를 검토한다.
- 고객 컨텍스트: 과거 경보 및 분석가 처리 이력을 확인한다.
- 글로벌 텔레메트리: Cloudflare 네트워크의 프라이버시 보호 인터넷 신호와 활동을 비교한다.
- 위협 인텔리전스: 승인된 사례 데이터와 지표를 검증한다.
종합 에이전트는 이러한 발견 사항을 승인된 어휘로 제한된 자문 보고서로 통합하며, 새로운 증거를 가져오거나 테넌트 경계를 넘나들 수 없다. 시스템은 불완전한 데이터를 투명하게 처리하기 위해 '확인되지 않음', '확인했으나 일치 없음', '부재 증거와 함께 확인됨'을 명시적으로 구분한다.
인간 개입 워크플로우
최종 자문은 속도 제한 규칙이나 WAF 맞춤 규칙 등 권장 다음 단계를 제공하지만, Managed Defense Analysts는 결정 및 완화 조치에 대한 전적인 책임을 유지한다. 기본 인프라는 상태 및 검증을 관리하기 위해 Cloudflare Workers, Workflows, D1, R2, Durable Objects를 사용한다. 현재 베타는 자격을 갖춘 애플리케이션 보안 경보에 제공되며, 향후 분기에 Custom Managed 수준과 지속 모니터링 에이전트로 확장할 계획이다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.