AI Briefing

Claude Code 토큰 50% 절감

Built a token optimizer for Claude Code : 50%+ input savings, 20%+ shorter output, both axes measured

·2026.04.21 23:13

핵심 내용

Claude Code의 반복 읽기와 장황한 출력을 줄여 input 50%+, output 20%+ 절감 효과를 측정했다.

자세히 보기

Claude Code에서 같은 파일을 반복해서 읽는 비용과, 답변을 장황하게 늘리는 prose 비용을 줄이기 위한 token optimizer를 만들었다.

구성은 세 부분이다.

  • caveman: UserPromptSubmit hook에서 출력 압축 규칙을 주입해, 코드·에러·커밋·PR은 유지하고 잡담·완곡표현만 제거했다.
  • OpenWolf: Read hook을 감싸 반복 파일 읽기를 캐시된 설명으로 대체하고, 프로젝트 메모리와 buglog를 세션 간 유지했다.
  • Dashboard: http://127.0.0.1:3847에서 세션별 토큰 사용량을 로컬 JSON으로 기록해 prose 축과 tool_use 토큰을 분리했다.

n=17 세션의 하한 추정치에서 input token 50%+ 절감, output 20%+ 단축, prose 축만 분리하면 35%+ 절감이 나왔다.

설치는 Claude Code 세션에 한 줄 명령을 붙여 넣는 방식이며, ~/.claude/settings.json을 백업한 뒤 npm run doctor로 검증하고, root 권한 없이 진행된다고 밝혔다.

이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.

AI 처리 방식을 확인하거나, 요약 오류와 출처 표기 문제, 삭제 요청을 문의 · 건의로 알려주세요.