에이전트 행동 표준 공개
Agent Behavior: 스킬과 달리 런타임 프롬프트가 아니라 트레이스 검토용으로 쓰는 에이전트 행동 표준
핵심 내용
Basis와 Braintrust가 에이전트 트레이스 검토 및 평가 기준을 정의하는 공개 표준 Agent Behavior를 공개했다.
자세히 보기
Basis와 Braintrust가 AI 에이전트의 행동 기준을 문서화하는 공개 표준 Agent Behavior를 공개했다. 이 표준은 에이전트가 작업을 수행하는 과정에서의 판단, 증거 수집, 실행, 복구 방식을 BEHAVIOR.md 파일 하나로 정의하여, 트레이스 검토와 평가 설계 시 참조할 단일 출처를 제공한다.
스킬 및 AGENTS.md와의 차이
Agent Behavior는 실행 중 모델에 로드되는 '스킬'이나 저장소 규칙을 담은 'AGENTS.md'와 달리, 트레이스 검토와 평가 설계를 주 목적으로 한다. 런타임 프롬프트에 주입되어 모델을 의도적으로 조종하기보다는, 에이전트가 어떻게 행동해야 하는지(정상적인 행동 기준)를 명확히 하여 평가자가 채점 기준을 확정하는 데 사용된다.
핵심 구성 및 권장 차원
규격은 .agents/behaviors/{이름}/BEHAVIOR.md 경로에 위치하며, YAML 프론트매터와 자유 형식 마크다운 본문으로 구성된다. 저자들은 실질적인 행동을 평가하기 위해 다음 6가지 차원을 권장한다.
- 의도(Intent): 행동의 중요성과 적용 시점
- 증거(Evidence): 판단 전 확인 및 검증 사항
- 판단(Decision): 추론 및 선택 과정
- 실행(Execution): 판단 후의 실제 행동
- 복구(Recovery): 실패나 모호함 발생 시 처리 방식
- 실패 모드(Failure modes): 방지해야 할 잘못된 행동
도입 및 검증 도구
이 표준은 긴 작업을 수행하는 에이전트를 운영하며 평가 기준의 일관성을 유지하려는 팀에 유용하다. 구조 검사를 위한 agentbehavior CLI 도구가 함께 제공되나, 현재 npm에 배포되지 않아 저장소를 복제해 빌드해야 한다. 도구는 파일 구조와 프론트매터 형식만 검증하며, 규격의 품질은 사람이나 모델의 판단에 맡겨진다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.