LLM 에이전트 검증 시 발생하는 'Verifier Tax' 연구
The Verifier Tax: Horizon-Dependent Safety–Success Tradeoffs in Tool-Using LLM Agents [R]
·2026.06.14 11:09
LLM 에이전트의 안전성 검증 과정에서 작업 단계가 길어질수록 성공률이 저하되는 'Verifier Tax' 현상이 발견되었다.
ACM CAIS 2026에서 발표된 이 연구는 도구 사용(Tool-using) LLM 에이전트의 안전성 평가를 다룹니다. 기존의 단순 작업 완료 여부 측정 방식은 에이전트가 정책을 위반하며 작업을 수행하는 'Unsafe Success'를 걸러내지 못한다는 한계가 있습니다.
연구진은 이를 해결하기 위해 2단계 검증 아키텍처를 제안했습니다.
- 1단계: 결정론적 정책 및 도구 체크(Deterministic policy/tool checks)
- 2단계: 문맥적 안전성을 위한 LLM 기반 검증기(LLM-based verifier)
연구 결과, 검증 프로세스는 'Unsafe Success'를 줄이는 데 효과적이지만, 작업의 단계(Horizon)가 길어질수록 전체적인 작업 성공률(Task completion)을 감소시키는 현상이 나타났습니다. 이를 연구진은 **'Verifier Tax(검증 세금)'**라고 정의하며, 에이전트의 안전성과 효율성 사이의 트레이드오프 관계를 규명했습니다.
이 요약은 원문 이해를 돕기 위한 큐레이션입니다. 저작권은 원저작자에게 있으며, 정확한 내용과 맥락은 원문을 확인하세요.
요약 오류, 출처 표기 문제, 삭제 요청은 문의 · 건의로 알려주세요.