AI Briefing

5개월 실전 하니스

Built a workflow harness specifically for Claude Code after 5 months of daily production use — free, open source (MIT)

·2026.04.16 01:10

핵심 내용

5개월간 매일 쓴 Claude Code에 계획·검토·평가 단계를 얹은 하니스 공개.

자세히 보기

AI 엔지니어가 5개월 동안 매일 생산 환경에서 쓴 뒤, Claude Code 위에 workflow harness를 직접 만들었다.

핵심 문제는 Claude Code가 강력하지만 기본적으로는 비구조적이라는 점이다. 파일은 편집하지만, 작업 시작 전 계획 검토, PR 직전 구조화된 평가, 팀 작업에 필요한 감사 추적이 부족해 결과를 계속 의심하게 됐다고 한다.

새로 만든 claude-code-harness는 Claude Code 위에 얹는 워크플로 계층으로, 모든 중요한 단계마다 사람의 승인 게이트를 둔다. 사용자가 명시적으로 "go"를 누르기 전에는 다음 단계로 진행하지 않는다.

구성은 다음과 같다.

  • 16개 skills(슬래시 커맨드)
  • 14개 sub-agents와 모델 라우팅
  • 5개 Node.js hooks
  • path-scoped rules
  • GitHub / Azure DevOps tracker adapter

설계의 중심도 Claude Code다. 계획과 판단은 Opus, 코드 작성은 Sonnet, 데이터 수집은 Haiku를 맡기고, 별도 프롬프트를 가진 adversarial evaluator가 PR 전에 실행 결과의 실패 지점을 적극적으로 찾는다.

소규모 개발자용 흐름에서는 /implement #42가 GitHub 이슈를 읽어 계획을 만들고, 사용자가 승인한 뒤 웨이브 단위로 구현과 테스트를 진행한다. 이후 적대적 평가를 거쳐 PR 초안을 만들지만, 최종 반영은 항상 사용자 확인이 필요하다.

엔터프라이즈 흐름에서는 /story로 5단계 라이프사이클을 돌리며 brief.md, plan.md, test-strategy.md, evaluation.md, acceptance 같은 산출물과 인수 계약을 남긴다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.