Claude API에서 Claude Sonnet 5.5는 Sonnet 5와 동일하게 백만 입력 토큰당 2달러, 백만 출력 토큰당 10달러입니다. 캐시 읽기는 백만당 0.20달러이며, 배치 API는 두 요율을 절반으로 줄여 1달러와 5달러로 제공합니다. 전체 100만 컨텍스트 창은 표준 요율로 청구되며, 고속 모드는 제공되지 않습니다. Sonnet 5의 9월 1일 예정이었던 3달러/15달러 인상은 취소되었으므로, 이제 2달러/10달러가 표준 가격입니다.
이 가이드는 Claude Sonnet 5.5 가격의 모든 항목을 나열하고, 계산과 함께 세 가지 비용 예시를 설명하며, 토큰당 요율보다 '노력'(effort)이 청구서에 더 큰 영향을 미치는 이유를 설명합니다. 이 모델이 처음이신가요? Claude Sonnet 5.5란 무엇인가로 시작하거나, Claude Sonnet 5.5를 무료로 사용하는 방법을 읽어보세요. 자신의 트래픽과 비교하여 숫자를 확인하려면, Apidog에서 요청을 보내고 각 응답의 usage 블록을 확인하세요.
Claude Sonnet 5.5 API 가격표
Anthropic의 가격 문서에 따른 백만 토큰(MTok)당 가격:
| 항목 | MTok당 가격 |
|---|---|
| 입력 | $2.00 |
| 5분 캐시 쓰기 | $2.50 |
| 1시간 캐시 쓰기 | $4.00 |
| 캐시 읽기 | $0.20 |
| 출력 | $10.00 |
| 배치 입력 | $1.00 |
| 배치 출력 | $5.00 |
다음 세 가지 세부 사항이 지불 금액을 변경합니다:
- 미국 전용 추론. Claude API 및 AWS의 Claude 플랫폼에서
inference_geo: "us"는 모든 토큰 범주에서 1.1배의 비용이 발생합니다 (입력 2.20달러, 출력 11달러, 캐시 읽기 0.22달러). Foundry의 미국 데이터 존 배포도 동일하게 1.1배가 적용되며, Bedrock과 Google Cloud는 별도로 가격이 책정됩니다. - 긴 컨텍스트 프리미엄 없음. 90만 토큰 요청은 9천 토큰 요청과 토큰당 비용이 동일합니다.
- Sonnet 5와 동일한 토크나이저. 토큰 개수는 변경 없이 그대로 유지됩니다.
정가로 Sonnet 5.5 비교
| 모델 | 입력 | 출력 | 참고 |
|---|---|---|---|
| Claude Sonnet 5.5 | $2 | $10 | 캐시 읽기 $0.20; 1M 컨텍스트; 고속 모드 없음 |
| Claude Sonnet 5 | $2 | $10 | 캐시 읽기 $0.20; $3/$15 인상 취소 |
| Claude Opus 5.5 | $4 | $20 | 캐시 읽기 $0.20; 고속 모드 $8/$40 |
| Claude Haiku 4.5 | $1 | $5 | 200k 컨텍스트 |
| GPT-6 Sol | $2 | $10 | 캐시된 입력 90% 할인; 872k 컨텍스트 |
| GPT-6 Luna | $0.10 | $0.50 | 1M 컨텍스트 |
Sonnet 5.5는 입력, 출력 및 캐시 쓰기에서 Opus 5.5의 절반 비용입니다. GPT-6 Sol과 정확히 $2/$10의 정가를 공유하므로, 이 둘 중 하나를 선택하는 것은 작업당 결과에 달려 있습니다. 배경 스토리는 Claude Sonnet 5 가격, 2026년 9월 가격 전쟁 및 GPT-6 Sol 가격을 참조하세요.
실제 요청 비용 예시
각 항목의 공식: 토큰 ÷ 1,000,000 × MTok당 가격. 각 항목의 가격을 계산한 다음 합산합니다.
예시 1: 하나의 채팅 스타일 요청
입력 토큰 3,000개, 출력 토큰 800개, 캐싱 없음.
- 입력: 3,000 ÷ 1,000,000 × $2 = $0.006
- 출력: 800 ÷ 1,000,000 × $10 = $0.008
- 총계: $0.006 + $0.008 = $0.014
이러한 요청 1,000개는 14달러가 소요됩니다. 출력은 토큰의 21%에 불과하지만 청구서의 57%를 차지하므로, 프롬프트 길이보다 출력 길이가 더 중요합니다.
예시 2: 50,000개 토큰 접두사를 다시 읽는 에이전트
에이전트 루프는 20번의 호출에서 동일한 50,000개 토큰 접두사(시스템 프롬프트, 도구, 저장소 컨텍스트)를 보냅니다. 여기서는 접두사만 가격이 책정됩니다.
캐시되지 않음: 20 × 50,000 = 1,000,000 토큰; 1,000,000 ÷ 1,000,000 × $2 = $2.00
5분 쓰기로 캐시됨:
- 호출 1이 캐시를 씁니다: 50,000 ÷ 1,000,000 × $2.50 = $0.125
- 호출 2부터 20까지 읽습니다: 19 × 50,000 = 950,000 토큰; 950,000 ÷ 1,000,000 × $0.20 = $0.19
- 총계: $0.125 + $0.19 = $0.315
이는 1.685달러, 약 84%를 절약합니다. 5분 쓰기는 호출이 해당 시간 창 내에 있을 때만 효과가 있습니다. 더 느린 루프의 경우, 1시간 쓰기 비용은 50,000 ÷ 1,000,000 × $4 = $0.20이므로 총액은 $0.20 + $0.19 = $0.39이며, 여전히 캐시되지 않은 경우보다 약 80% 저렴합니다. 동일한 추론은 저희의 프롬프트 캐싱 비용 계산에서 Opus에 대해 적용됩니다. 0.20달러의 읽기 요율은 동일합니다.
예시 3: 10,000개 요청의 배치 작업
예시 1과 동일한 형태로 배치 API를 통해 전송됩니다.
- 입력: 10,000 × 3,000 = 30,000,000 토큰; 30 × $1 = $30
- 출력: 10,000 × 800 = 8,000,000 토큰; 8 × $5 = $40
- 배치 총액: $70, 표준 요율 30 × $2 + 8 × $10 = $140 대비
배치는 또한 output-300k-2026-03-24 베타를 통해 출력 제한을 128K 토큰에서 300K 토큰으로 늘립니다.
토큰당 비용이 아닌 작업당 비용
요금표는 토큰당 비용을 알려주지만, 작업에 소모되는 토큰 수를 알려주지는 않습니다. 두 번째 숫자는 모델 간의 어떤 요율 차이보다 '노력'(effort)에 따라 훨씬 더 크게 변동합니다.
Anthropic은 자체 테스트에서 Sonnet 5.5가 "이전 모델보다 작업당 비용이 최대 30% 적게 든다"고 말합니다. 출시 게시물에는 모든 노력(effort) 수준에서의 비용도 나타나 있습니다. Terminal-Bench 4.0 실행은 Anthropic 자체에서, FrontierCode는 Cognition에서, 그리고 인덱스 비용은 Artificial Analysis에서 가져온 것입니다:
| 노력 | Terminal-Bench 4.0 (점수, 시도당 $) | FrontierCode v1.1 (점수, 작업당 $) | AA 인덱스 (점수, 실행 비용) |
|---|---|---|---|
| 낮음 | 20.0%, $0.76 | 29.3%, $0.19 | 35.8, $544 |
| 중간 | 28.8%, $0.83 | 36.5%, $0.24 | 40.7, $701 |
| 높음 | 43.0%, $1.94 | 49.4%, $0.42 | 46.7, $1,176 |
| 매우 높음 | 61.5%, $5.30 | 52.1%, $1.59 | 51.9, $2,738 |
| 최대 | 70.6%, $12.54 | 46.2%, $20.78 | 56.0, $8,977 |
눈에 띄는 점:
- Terminal-Bench에서 최대 노력(max)은 높은 노력(high)보다 약 6.5배의 비용이 듭니다 ($12.54 ÷ $1.94 = 6.46). Artificial Analysis의 인덱스 비용은 최대 노력(max)에서 낮음(low)보다 약 16.5배 더 많이 소요됩니다 ($8,977 ÷ $544).
- 더 많은 노력이 항상 더 좋은 것은 아닙니다. FrontierCode는 매우 높음(xhigh)에서 52.1%에서 최대(max)에서 46.2%로 떨어지는 반면, 작업당 비용은 13배 증가합니다 ($20.78 ÷ $1.59). Anthropic의 각주에 따르면, 최대 노력(max)에서 모델은 서브 에이전트를 확장하는 검토 기술을 더 자주 실행했으며, 이는 Cognition이 조사한 사례에서 시간 초과 또는 범위를 벗어난 편집을 야기했습니다.
- 낮은 노력 수준의 Opus도 경쟁력이 있습니다. 중간 노력 수준의 Opus 5.5는 Terminal-Bench에서 $2.94로 57.6%를 기록했으며, 이는 높은 노력 수준의 Sonnet 5.5가 $1.94로 43.0%를 기록한 것과 비교됩니다. Sonnet 5.5 대 Opus 5.5 비교에서 이러한 트레이드오프를 설명합니다.
최대 노력(max)에서의 장황함은 또 다른 함정입니다. OfficeChai가 작성한 Artificial Analysis 데이터에 따르면 Sonnet 5.5는 최대 노력(max)에서 인덱스 작업당 약 193,000개의 출력 토큰을 사용하며, 작업당 비용은 Sonnet 5보다 약 50% 높습니다. Simon Willison은 Hacker News에서 최대 노력(max-effort) 실행이 128,000개의 '생각' 토큰을 소모하고 답변을 생성하기 전에 중단되었다고 보고했습니다.
비용을 절감하는 6가지 방법
- 노력(effort)을 의도적으로 설정하세요. API는 기본적으로
high로 설정되어 있으며, Claude Code와 Claude 앱은 기본적으로medium으로 설정됩니다. Anthropic의 프롬프트 가이드는 채팅에medium또는low를 권장하며, 측정 가능한 품질 향상을 위해서만xhigh또는max를 사용하라고 제안합니다. Sonnet 5 설정을 그대로 사용하지 마세요. 스케일이 재조정되었습니다. - '생각' 기능을 껐던 곳에
between_tools를 사용하세요.thinking: {"type": "disabled"}는 이제 400 오류를 반환합니다.{"type": "between_tools"}가low,medium,high에서 이를 대체합니다. - 재사용되는 모든 것을 캐시하세요. 캐시 가능한 최소 프롬프트는 512 토큰입니다 (Sonnet 5에서는 1,024 토큰). 요청 간에 최상위
effort를 변경하면 캐시가 무효화되므로, 이를 일정하게 유지하세요. - 기다릴 수 있는 것은 배치 처리하세요. 입력 및 출력 가격이 절반입니다.
max_tokens를 정직하게 유지하세요. Anthropic의 가이드는stop_reason: "max_tokens"를 실패한 응답으로 간주하므로, 잘린 답변은 출하할 것이 없는 채로 소모되는 비용입니다.- 요청하지 않은 작업을 줄이세요. Sonnet 5.5는 요청하지 않은 테스트, 문서 및 파일을 추가하고,
xhigh및max에서 추가 검토 라운드를 시작합니다. Anthropic이 제안한 시스템 프롬프트 문단은 품질 변화 없이max에서 세션 비용을 약 3분의 1 줄였습니다.
Sonnet 5.5에 대해 다른 곳에서 지불하는 곳
- Claude 요금제 (claude.com/pricing): 무료는 0달러이며, Claude Code 없이 채팅에서 Sonnet을 포함합니다. Pro는 연간 청구 시 월 17달러 또는 월별 20달러입니다. Max는 월 100달러부터 시작합니다. 팀 좌석은 연간/월별로 $20/$25 (표준) 또는 $100/$125 (프리미엄)입니다. 이 중 어느 것도 API 접근을 포함하지 않습니다.
- GitHub Copilot: Pro (월 10달러), Pro+, Max, Business 및 Enterprise는 제공업체 정가로 청구됩니다. Copilot Pro는 월 1,500개의 AI 크레딧을 개당 0.01달러에 포함하며, 이는 약 15달러 상당의 토큰 또는 대략 1,070개의 예시 1 요청 ($15 ÷ $0.014)에 해당합니다. Copilot Free 및 Student는 이를 선택할 수 없습니다.
- Cursor: Other Models 풀 (Pro, Pro Plus 및 Ultra)에서 동일한 요율이 적용되며, 미국 전용 엔드포인트의 경우 10% 추가됩니다 ($2.20/$11).
- OpenRouter: $2/$10, 또는
:batch변형에서는 $1/$5.:free변형은 없습니다. - Vercel AI Gateway: $0.20 캐시 읽기와 함께 $2/$10. 5달러 무료 크레딧은 Sonnet 5.5를 포함하지 않습니다.
- Bedrock, Google Cloud, Foundry: 각 클라우드 자체 가격 페이지를 참조하세요. Bedrock은 배치(Batch) 없이 표준(Standard) 티어만 지원합니다.
대신 크레딧을 찾고 계신가요? 무료 Claude Sonnet 5.5 API가 있나요를 참조하세요.
Apidog에서 요청당 비용 추적
모든 메시지 응답에는 input_tokens, output_tokens 및 캐시 수를 포함하는 usage 객체가 있습니다. 이것만으로 Apidog에서 모든 호출 가격을 계산하기에 충분합니다:

- 키를
ANTHROPIC_API_KEY환경 변수로 저장하세요. - 동일한 프롬프트로 각 노력 수준(
low,medium,high)별로 이 요청을 한 번씩 저장하세요:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 4000,
"thinking": {"type": "between_tools"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- 호출 가격을 계산하고 잘림(truncation) 시 실패하는 후처리기를 추가하세요:
const body = pm.response.json();
const u = body.usage;
const cost = (u.input_tokens * 2 + u.output_tokens * 10) / 1e6;
pm.environment.set("last_call_usd", cost.toFixed(5));
pm.test("not truncated", () => pm.expect(body.stop_reason).to.not.eql("max_tokens"));
- 세 가지 모두 실행하고
usage.output_tokens와 비용을 나란히 비교하세요. 캐시를 사용하는 경우, 해당 요율로 캐시 수를 추가하세요.
전체 요청 과정은 Claude Sonnet 5.5 API 사용 방법에 있습니다.
자주 묻는 질문 (FAQ)
Claude Sonnet 5.5는 백만 토큰당 얼마인가요? Claude API에서 입력 2달러, 출력 10달러입니다. 캐시 읽기는 0.20달러이며, 배치 API는 1달러와 5달러를 청구합니다.
Sonnet 5.5가 Sonnet 5보다 비싼가요? 아닙니다. 토큰당 가격은 동일하며, Anthropic은 자체 테스트에서 Sonnet 5.5가 작업당 최대 30% 더 저렴하다고 말합니다.
20만 토큰 이상에 대한 추가 요금이 있나요? 아닙니다. 전체 100만 컨텍스트 창은 표준 요율로 청구됩니다.
Sonnet 5.5에 고속 모드가 있나요? 아닙니다. 고속 모드는 Opus 5.5, Opus 5 및 Opus 4.8에서만 사용할 수 있습니다.
Claude Sonnet 5.5는 무료인가요? Claude 채팅 앱에서는 그렇습니다. 누구나 무료 요금제로 채팅할 수 있습니다. API는 선불 크레딧으로 운영되며, 무료 API 가이드에서 크레딧 프로그램을 다룹니다.
다음 단계: 자신의 작업 부하 비용 책정
가장 일반적인 요청 형태 세 가지를 선택하여 각각 두 가지 노력(effort) 수준으로 실행하고, usage 숫자를 위 표에 곱하세요. 그러면 medium이 품질 기준을 충족하는지 또는 high가 추가 토큰 비용을 들일 가치가 있는지 빠르게 확인할 수 있습니다. 해당 요청과 비용 스크립트를 나란히 유지하려면 Apidog를 다운로드하세요.
