Claude 모델 토큰 사용량
기준일: 2026-07-30
Anthropic 공식 Claude Platform 문서를 기준으로 작성했다. 모델, 가격, 제공 상태는 변경될 수 있으므로 실제 사용 전에는 Claude 모델 개요와 Claude 가격표를 다시 확인한다.
이 글을 쓰는 이유
Claude 모델을 선택할 때는 모델 이름이나 성능 순위만 보는 것보다 입력 토큰과 출력 토큰의 가격, 컨텍스트 윈도우, 최대 출력량을 함께 살펴봐야 한다. 특히 Claude는 일반 입력, 프롬프트 캐시 생성, 캐시 적중, 출력에 서로 다른 단가를 적용하며, 모델에 따라 컨텍스트 크기와 thinking 기능도 달라진다.
이 글의 목적은 Claude API를 사용하는 개발자가 모델별 토큰 사용량과 비용 구조를 한눈에 비교할 수 있도록 공개된 정보를 정리하는 것이다. 최신 모델뿐 아니라 이전 세대와 제한 공개 모델도 함께 기록해, 기존 프로젝트의 모델 ID를 확인하거나 마이그레이션 계획을 세울 때 참고할 수 있도록 했다.
다음과 같은 독자에게 유용하다.
- Claude API 또는 Claude Code를 처음 사용하는 개발자
- 코드 생성, 에이전트, 문서 분석에 적합한 Claude 모델을 비교하려는 사용자
- 입력·출력 토큰 비용과 프롬프트 캐시 비용을 예측해야 하는 팀
- 기존 Claude 3 또는 Claude 4 모델을 최신 모델로 이전하려는 개발자
아래 단가는 API 기준이다. Claude 웹 앱과 Claude Code를 Pro 또는 Max 구독으로 사용하는 경우에는 API 단가가 직접 적용되지 않으며, 구독 플랜별 사용량 제한과 rate limit을 별도로 확인해야 한다.
용어
- 입력 토큰: 프롬프트, 대화 기록, 시스템 지침, 도구 정의와 도구 결과처럼 Claude에 전달되는 토큰이다.
- 출력 토큰: Claude가 생성한 응답 토큰이다. extended thinking을 사용하는 경우 thinking 토큰도 사용량에 영향을 줄 수 있다.
- 컨텍스트 윈도우: 한 요청에서 입력과 출력을 합쳐 처리할 수 있는 최대 토큰 범위다.
- 캐시 쓰기: 반복해서 사용할 프롬프트를 캐시에 저장할 때 발생하는 입력 토큰이다. 5분 캐시와 1시간 캐시의 단가가 다르다.
- 캐시 적중: 기존 캐시에서 재사용된 입력 토큰이다. 일반 입력보다 낮은 단가가 적용된다.
- MTok: Million tokens, 즉 100만 토큰이다.
최신 Claude 모델
| 모델 | API 모델 ID | 컨텍스트 윈도우 | 최대 출력 | 입력 / MTok | 5분 캐시 쓰기 | 1시간 캐시 쓰기 | 캐시 적중 | 출력 / MTok |
|---|---|---|---|---|---|---|---|---|
| Claude Fable 5 | claude-fable-5 |
1M | 128K | $10.00 | $12.50 | $20.00 | $1.00 | $50.00 |
| Claude Opus 5 | claude-opus-5 |
1M | 128K | $5.00 | $6.25 | $10.00 | $0.50 | $25.00 |
| Claude Sonnet 5 | claude-sonnet-5 |
1M | 128K | $2.00* | $2.50* | $4.00* | $0.20* | $10.00* |
| Claude Haiku 4.5 | claude-haiku-4-5 |
200K | 64K | $1.00 | $1.25 | $2.00 | $0.10 | $5.00 |
* Claude Sonnet 5의 출시 프로모션 단가는 2026-08-31까지 적용되며, 2026-09-01부터 입력 $3.00, 5분 캐시 쓰기 $3.75, 1시간 캐시 쓰기 $6.00, 캐시 적중 $0.30, 출력 $15.00으로 변경될 예정이다.
Claude Fable 5는 일반 공개 모델이다. claude-mythos-5는 Fable 5와 같은 사양과 가격을 사용하지만 Project Glasswing의 승인 고객을 대상으로 하는 제한 공개 모델이므로 일반 API 사용자가 바로 선택할 수 있는 모델로 보기는 어렵다.
출처: Claude 모델 개요, Claude 가격표
Claude 4 계열
| 모델 | API 모델 ID | 컨텍스트 윈도우 | 최대 출력 | 입력 / MTok | 출력 / MTok | 상태 |
|---|---|---|---|---|---|---|
| Claude Opus 4.8 | claude-opus-4-8 |
1M | 128K | $5.00 | $25.00 | 최신 |
| Claude Opus 4.7 | claude-opus-4-7 |
1M | 128K | $5.00 | $25.00 | 사용 가능 |
| Claude Opus 4.6 | claude-opus-4-6 |
1M | 128K | $5.00 | $25.00 | 사용 가능 |
| Claude Opus 4.5 | claude-opus-4-5 |
1M | 128K | $5.00 | $25.00 | 사용 가능 |
| Claude Sonnet 4.6 | claude-sonnet-4-6 |
1M | 64K | $3.00 | $15.00 | 사용 가능 |
| Claude Sonnet 4.5 | claude-sonnet-4-5 |
1M | 64K | $3.00 | $15.00 | 사용 가능 |
| Claude Opus 4.1 | claude-opus-4-1 |
공식 현재 사양 확인 필요 | 공식 현재 사양 확인 필요 | $15.00 | $75.00 | Deprecated |
| Claude Opus 4 | claude-opus-4-20250514 |
공식 현재 사양 확인 필요 | 공식 현재 사양 확인 필요 | $15.00 | $75.00 | 대부분 플랫폼 Retired |
| Claude Sonnet 4 | claude-sonnet-4-20250514 |
공식 현재 사양 확인 필요 | 공식 현재 사양 확인 필요 | $3.00 | $15.00 | 대부분 플랫폼 Retired |
Opus 4.7, Opus 4.6, Sonnet 4.6은 Messages API의 동기 요청에서 표의 최대 출력량을 사용한다. Message Batches API에서는 일부 모델에 별도 beta 헤더를 사용해 최대 300K 출력 토큰을 요청할 수 있다.
이전 세대 및 레거시 모델
| 모델 | 대표 API 모델 ID | 컨텍스트 / 최대 출력 | 입력 / MTok | 5분 캐시 쓰기 | 1시간 캐시 쓰기 | 캐시 적중 | 출력 / MTok | 상태 |
|---|---|---|---|---|---|---|---|---|
| Claude Haiku 3.5 | claude-3-5-haiku-20241022 |
공식 현재 사양 확인 필요 | $0.80 | $1.00 | $1.60 | $0.08 | $4.00 | Retired 일부 플랫폼 제외 |
| Claude Sonnet 3.7 | claude-3-7-sonnet-20250219 |
공식 현재 사양 확인 필요 | $3.00 | $3.75 | $6.00 | $0.30 | $15.00 | 가격표에 등재된 레거시 모델 |
| Claude Sonnet 3.5 | claude-3-5-sonnet-20241022 |
공식 현재 사양 확인 필요 | $3.00 | $3.75 | $6.00 | $0.30 | $15.00 | Deprecated |
| Claude Opus 3 | claude-3-opus-20240229 |
공식 현재 사양 확인 필요 | $15.00 | $18.75 | $30.00 | $1.50 | $75.00 | Deprecated |
| Claude Haiku 3 | claude-3-haiku-20240307 |
공식 현재 사양 확인 필요 | $0.25 | $0.30 | $0.50 | $0.03 | $1.25 | 레거시 |
Anthropic의 현재 모델 개요는 최신 모델의 컨텍스트 윈도우와 최대 출력량을 중심으로 제공한다. 따라서 레거시 모델은 오래된 문서의 수치를 현재 사양인 것처럼 단정하지 않고, 공식 최신 페이지에서 확인되지 않는 값은 공식 현재 사양 확인 필요로 표시했다. 이미 레거시 모델을 사용하는 프로젝트라면 모델 deprecation 문서에서 종료 일정을 먼저 확인해야 한다.
비용 계산 예시
Claude Sonnet 5에 입력 20,000 토큰과 출력 5,000 토큰을 보낸 경우, 2026-08-31까지의 프로모션 단가는 다음과 같다.
입력 비용 = 20,000 / 1,000,000 × $2.00 = $0.040
출력 비용 = 5,000 / 1,000,000 × $10.00 = $0.050
합계 = $0.090
캐시 적중 입력 20,000 토큰이라면 캐시 적중 단가 $0.20/MTok을 적용해 입력 비용은 $0.004가 된다. 반대로 캐시를 새로 쓰는 요청은 5분 또는 1시간 캐시 쓰기 단가가 적용된다.
도구와 에이전트 사용 시 추가 토큰
Claude API에서 실제 입력량은 사용자가 입력한 문장만으로 결정되지 않는다. 다음 항목도 입력 토큰에 포함될 수 있다.
- 대화의 이전 user/assistant 메시지
- 시스템 프롬프트
tools파라미터에 포함한 도구 이름, 설명, JSON 스키마tool_use및tool_result블록- 웹 검색 결과와 웹 fetch 결과
- Bash, 컴퓨터 사용, 텍스트 편집기 도구의 시스템 프롬프트와 실행 결과
따라서 Claude Code나 에이전트에서 한 번의 작업이 소비하는 토큰은 단순한 질문의 길이보다 커질 수 있다. 실제 사용량은 API 응답의 usage 객체에서 input_tokens, cache_creation_input_tokens, cache_read_input_tokens, output_tokens를 확인해야 한다.
Claude 앱과 API의 차이
| 사용 방식 | 비용 및 사용량 기준 |
|---|---|
| Claude API / API key | 모델별 입력, 캐시, 출력 토큰 단가로 계산 |
| Claude Code + API key | Claude API와 동일하게 실제 토큰 사용량으로 계산 |
| Claude 웹 앱 / Claude Code + Pro·Max 구독 | 구독 플랜별 사용량 제한과 rate limit 적용, API 단가로 직접 청구되지 않음 |
| Bedrock·Google Cloud·Microsoft Foundry | 각 클라우드 제공자의 가격과 엔드포인트 정책 적용 가능 |
정리
- 가장 높은 성능과 긴 작업에는 Claude Fable 5 또는 Claude Opus 5를 고려할 수 있다.
- 성능과 비용의 균형이 필요하면 Claude Sonnet 5 또는 Sonnet 4.6이 적합하다.
- 빠르고 저렴한 대량 처리는 Claude Haiku 4.5가 유리하다.
- 반복되는 긴 시스템 프롬프트나 코드베이스는 프롬프트 캐싱으로 입력 비용을 줄일 수 있다.
- 레거시 모델은 가격보다 종료 일정과 마이그레이션 가능성을 먼저 확인해야 한다.











