ADR: 에이전트형 AI 탐지 및 대응 (GitHub 저장소)
핵심 내용
Uber가 기업용 AI 에이전트 보안 시스템 ADR을 오픈소스로 공개했다.
자세히 보기
**ADR(Agentic AI Detection and Response)**은 Cursor, Claude Code, Codex 같은 직원용 AI 에이전트와 고객지원 에이전트를 보호하는 기업용 보안 시스템이다. Uber의 프로덕션 환경에 배포됐으며, 관련 논문은 MLSys 2026에 채택됐다.
ADR은 다음 네 가지 기능으로 에이전트 보안을 강화한다.
- Observability: macOS, Linux, Windows에서 7개 이상의 AI 코딩 도구와 내부 자동화·고객지원 에이전트의 의도, 도구 사용, 실행 추적을 수집한다.
- Benchmark: ADR-Bench를 통해 300개 이상의 작업, 133개 MCP 서버, 17가지 에이전트 공격 기법을 평가한다.
- Detection: 고재현율 트리아지와 의심 세션에 대한 심층 에이전트 추론을 결합한 2단계 탐지 구조를 사용한다.
- Prevention: 위험한 작업을 실행 전에 차단하는 기능으로, 현재 오픈소스 공개 범위에는 포함되지 않았다.
공개 저장소에는 ADR Sensor, ADR-Bench 및 Detector가 포함된다. Sensor는 Claude Code, Cursor, Codex 등의 텔레메트리를 수집·정규화하고, Detection 디렉터리는 듀얼 에이전트 탐지기와 133개 MCP 서버, 303개 벤치마크 작업, 기준선 및 논문용 그래프 스크립트를 제공한다. 사전 배포 레드팀에 사용하는 오프라인 ADR Explorer 엔진은 공개되지 않았다.
사용자는 저장소를 복제한 뒤 uv sync로 의존성을 설치하고 Anthropic·OpenAI API 키를 설정해 탐지기를 실행할 수 있다. 기본 탐지기는 adr이며, API 키 없이 연기 테스트를 진행하려면 --detector llamafirewall 옵션을 사용할 수 있다. 프로젝트는 Apache License 2.0으로 배포되며, 일부 벤더링된 AgentDojo 코드는 별도의 MIT 라이선스를 따른다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.