Claude 4.7 토크나이저 비용 측정 결과
·2026.04.18 07:28
핵심 내용
Claude 4.7은 토큰이 1.3~1.45배 늘고 준수도는 소폭 개선됐다.
자세히 보기
Claude Opus 4.7은 4.6보다 평균 1.3~1.45배 더 많은 토큰을 만들어, 같은 가격 체계에서도 세션당 비용이 20~30% 늘어났다.
실측은 Anthropic API의 POST /v1/messages/count_tokens로 진행했다. 실제 Claude Code 사용 샘플 7개와 영어, 코드, 구조화 데이터, CJK, 이모지, 수학 기호를 포함한 12개 인공 샘플을 비교했다.
- 실사용 샘플 가중 평균: 1.325배 증가 (8,254 → 10,937 tokens)
- 영어·코드 콘텐츠 평균: 1.345배
- CJK(중국어·일본어·한국어): 1.01배로 거의 변화 없음
- 기술 문서: 1.47배, Shell script: 1.39배, TypeScript: 1.36배
- 영어 산문: 1.20배, JSON: 1.13배
증가 패턴은 영어와 코드에서 특히 두드러졌다. 반복 문자열, 키워드, 식별자 등이 더 잘게 분해되면서 같은 텍스트가 더 많은 토큰으로 표현됐다. 반대로 CJK, 이모지, 기호는 변화가 거의 없었다.
명령어 준수도는 IFEval 샘플 테스트에서 소폭 개선됐다.
- 엄격 모드 프롬프트 단위: 85% → 90% (+5pp)
- 엄격 모드 명령 단위: 86% → 90% (+4pp)
- 개선은 주로 formatting 오류 감소에서 나타남
세션 비용 추정에서는 캐시 프리픽스와 대화 이력이 함께 커지며, 캐시 읽기·쓰기 비용과 레이트 리밋 소모 속도가 모두 증가하는 것으로 계산했다. 80회 왕복 세션 가정에서 4.6은 약 $6.65, 4.7은 약 $7.86~$8.76로 추정돼, 모델 단가가 같아도 실제 운영비는 더 올라간다.
핵심 결론은 정확도와 세밀한 명령 수행력 향상을 얻는 대신, 특히 영어·코드 중심 워크로드에서 추가 토큰 비용을 감수해야 하는 모델이라는 점이다.
이 한국어 요약은 AI가 자동으로 만들었습니다. 원문의 주장과 맥락은 원문에서 확인해 주세요. 저작권은 원저작자에게 있습니다.