How much does Claude Code actually cost per session? I did the math

개요

Claude Code와 같은 에이전트 도구의 세션별 비용은 수십 번의 모델 호출과 입력 토큰의 누적으로 인해 예상보다 훨씬 높을 수 있으며, 이는 주로 입력 볼륨에 의해 결정된다.

주요 내용

* 비용 구조: Claude Code의 비용은 주로 입력 토큰에 의해 발생하며, 시스템 프롬프트, 도구 정의, 파일 읽기, 도구 결과, 에이전트 루프 자체에서 발생하는 토큰들이 매 모델 호출마다 포함되어 과금된다.
* 비용 완화 메커니즘: 프롬프트 캐싱(캐시 읽기 비용 절감)과 /compact 명령(히스토리 요약)이 비용을 줄이는 데 도움을 주지만, 창(window) 내 모든 내용은 각 호출마다 과금된다는 기본 규칙은 유지된다.
* 세션별 비용 계산: 일반적인 중간 규모 세션은 약 40회의 모델 호출을 거치며, 누적된 파일과 테스트 결과로 인해 평균 90K 토큰을 사용하므로 3.6M 입력 토큰이 발생하며, 이는 Sonnet 모델 기준 약 $11.40, Opus 모델 기준 약 $19.00의 비용이 발생한다.
* 요금제 vs API: 월 $20의 플랜은 Sonnet 기준 약 두 번의 세션만 사용해도 본전을 뽑지만, 사용량 제한에 걸리면 오히려 비효율적일 수 있어, 대규모 사용자는 플랜과 API를 혼합하여 사용한다.
* 비용 절감 레버: CLAUDE.md 간결하게 유지, 파일 읽기 범위 제한, 불필요한 MCP 서버 비활성화, 모델 라우팅(Opus는 복잡한 작업, Sonnet은 기본, 저가 모델은 상용구 작업) 등을 통해 비용을 절감할 수 있다.
* API 엔드포인트 변경: ANTHROPIC_BASE_URL 설정을 변경하여 OpenAI 호환 게이트웨이를 통해 더 저렴한 요금으로 Claude Code를 사용할 수 있으며, 이는 단 한 줄의 설정 변경으로 가능하다.

시사점

Claude Code와 같은 에이전트 도구의 비용은 단순히 모델 호출 횟수보다는 입력 토큰 누적량에 크게 좌우되므로, 비용 효율적인 사용을 위해서는 시스템 프롬프트 최적화, 토큰 사용량 관리, 적절한 모델 선택 및 라우팅 전략이 필수적이다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions