AI Briefing

ADR: 에이전트형 AI 탐지 및 대응 (GitHub 저장소)

·2026.08.06 09:00

핵심 내용

Uber가 기업용 AI 에이전트 보안 시스템 ADR을 오픈소스로 공개했다.

자세히 보기

**ADR(Agentic AI Detection and Response)**은 Cursor, Claude Code, Codex 같은 직원용 AI 에이전트와 고객지원 에이전트를 보호하는 기업용 보안 시스템이다. Uber의 프로덕션 환경에 배포됐으며, 관련 논문은 MLSys 2026에 채택됐다.

ADR은 다음 네 가지 기능으로 에이전트 보안을 강화한다.

  • Observability: macOS, Linux, Windows에서 7개 이상의 AI 코딩 도구와 내부 자동화·고객지원 에이전트의 의도, 도구 사용, 실행 추적을 수집한다.
  • Benchmark: ADR-Bench를 통해 300개 이상의 작업, 133개 MCP 서버, 17가지 에이전트 공격 기법을 평가한다.
  • Detection: 고재현율 트리아지와 의심 세션에 대한 심층 에이전트 추론을 결합한 2단계 탐지 구조를 사용한다.
  • Prevention: 위험한 작업을 실행 전에 차단하는 기능으로, 현재 오픈소스 공개 범위에는 포함되지 않았다.

공개 저장소에는 ADR Sensor, ADR-Bench 및 Detector가 포함된다. Sensor는 Claude Code, Cursor, Codex 등의 텔레메트리를 수집·정규화하고, Detection 디렉터리는 듀얼 에이전트 탐지기와 133개 MCP 서버, 303개 벤치마크 작업, 기준선 및 논문용 그래프 스크립트를 제공한다. 사전 배포 레드팀에 사용하는 오프라인 ADR Explorer 엔진은 공개되지 않았다.

사용자는 저장소를 복제한 뒤 uv sync로 의존성을 설치하고 Anthropic·OpenAI API 키를 설정해 탐지기를 실행할 수 있다. 기본 탐지기는 adr이며, API 키 없이 연기 테스트를 진행하려면 --detector llamafirewall 옵션을 사용할 수 있다. 프로젝트는 Apache License 2.0으로 배포되며, 일부 벤더링된 AgentDojo 코드는 별도의 MIT 라이선스를 따른다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.