클로드 소네트 5.5 요금: API, 캐싱, 배치, 요금제 완벽 분석 가이드

클로드 소네트 5.5 가격: 백만 토큰당 2달러/10달러, 캐시 읽기 0.20달러, 배치는 반값. 비용 예시, 노력 비용, 및 요금제 가격.

Ashley Goolam

Ashley Goolam

29 September 2026

클로드 소네트 5.5 요금: API, 캐싱, 배치, 요금제 완벽 분석 가이드

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

Claude API에서 Claude Sonnet 5.5는 Sonnet 5와 동일하게 백만 입력 토큰당 2달러, 백만 출력 토큰당 10달러입니다. 캐시 읽기는 백만당 0.20달러이며, 배치 API는 두 요율을 절반으로 줄여 1달러와 5달러로 제공합니다. 전체 100만 컨텍스트 창은 표준 요율로 청구되며, 고속 모드는 제공되지 않습니다. Sonnet 5의 9월 1일 예정이었던 3달러/15달러 인상은 취소되었으므로, 이제 2달러/10달러가 표준 가격입니다.

이 가이드는 Claude Sonnet 5.5 가격의 모든 항목을 나열하고, 계산과 함께 세 가지 비용 예시를 설명하며, 토큰당 요율보다 '노력'(effort)이 청구서에 더 큰 영향을 미치는 이유를 설명합니다. 이 모델이 처음이신가요? Claude Sonnet 5.5란 무엇인가로 시작하거나, Claude Sonnet 5.5를 무료로 사용하는 방법을 읽어보세요. 자신의 트래픽과 비교하여 숫자를 확인하려면, Apidog에서 요청을 보내고 각 응답의 usage 블록을 확인하세요.

Claude Sonnet 5.5 API 가격표

Anthropic의 가격 문서에 따른 백만 토큰(MTok)당 가격:

항목 MTok당 가격
입력 $2.00
5분 캐시 쓰기 $2.50
1시간 캐시 쓰기 $4.00
캐시 읽기 $0.20
출력 $10.00
배치 입력 $1.00
배치 출력 $5.00

다음 세 가지 세부 사항이 지불 금액을 변경합니다:

정가로 Sonnet 5.5 비교

모델 입력 출력 참고
Claude Sonnet 5.5 $2 $10 캐시 읽기 $0.20; 1M 컨텍스트; 고속 모드 없음
Claude Sonnet 5 $2 $10 캐시 읽기 $0.20; $3/$15 인상 취소
Claude Opus 5.5 $4 $20 캐시 읽기 $0.20; 고속 모드 $8/$40
Claude Haiku 4.5 $1 $5 200k 컨텍스트
GPT-6 Sol $2 $10 캐시된 입력 90% 할인; 872k 컨텍스트
GPT-6 Luna $0.10 $0.50 1M 컨텍스트

Sonnet 5.5는 입력, 출력 및 캐시 쓰기에서 Opus 5.5의 절반 비용입니다. GPT-6 Sol과 정확히 $2/$10의 정가를 공유하므로, 이 둘 중 하나를 선택하는 것은 작업당 결과에 달려 있습니다. 배경 스토리는 Claude Sonnet 5 가격, 2026년 9월 가격 전쟁 및 GPT-6 Sol 가격을 참조하세요.

실제 요청 비용 예시

각 항목의 공식: 토큰 ÷ 1,000,000 × MTok당 가격. 각 항목의 가격을 계산한 다음 합산합니다.

예시 1: 하나의 채팅 스타일 요청

입력 토큰 3,000개, 출력 토큰 800개, 캐싱 없음.

이러한 요청 1,000개는 14달러가 소요됩니다. 출력은 토큰의 21%에 불과하지만 청구서의 57%를 차지하므로, 프롬프트 길이보다 출력 길이가 더 중요합니다.

예시 2: 50,000개 토큰 접두사를 다시 읽는 에이전트

에이전트 루프는 20번의 호출에서 동일한 50,000개 토큰 접두사(시스템 프롬프트, 도구, 저장소 컨텍스트)를 보냅니다. 여기서는 접두사만 가격이 책정됩니다.

캐시되지 않음: 20 × 50,000 = 1,000,000 토큰; 1,000,000 ÷ 1,000,000 × $2 = $2.00

5분 쓰기로 캐시됨:

이는 1.685달러, 약 84%를 절약합니다. 5분 쓰기는 호출이 해당 시간 창 내에 있을 때만 효과가 있습니다. 더 느린 루프의 경우, 1시간 쓰기 비용은 50,000 ÷ 1,000,000 × $4 = $0.20이므로 총액은 $0.20 + $0.19 = $0.39이며, 여전히 캐시되지 않은 경우보다 약 80% 저렴합니다. 동일한 추론은 저희의 프롬프트 캐싱 비용 계산에서 Opus에 대해 적용됩니다. 0.20달러의 읽기 요율은 동일합니다.

예시 3: 10,000개 요청의 배치 작업

예시 1과 동일한 형태로 배치 API를 통해 전송됩니다.

배치는 또한 output-300k-2026-03-24 베타를 통해 출력 제한을 128K 토큰에서 300K 토큰으로 늘립니다.

토큰당 비용이 아닌 작업당 비용

요금표는 토큰당 비용을 알려주지만, 작업에 소모되는 토큰 수를 알려주지는 않습니다. 두 번째 숫자는 모델 간의 어떤 요율 차이보다 '노력'(effort)에 따라 훨씬 더 크게 변동합니다.

Anthropic은 자체 테스트에서 Sonnet 5.5가 "이전 모델보다 작업당 비용이 최대 30% 적게 든다"고 말합니다. 출시 게시물에는 모든 노력(effort) 수준에서의 비용도 나타나 있습니다. Terminal-Bench 4.0 실행은 Anthropic 자체에서, FrontierCode는 Cognition에서, 그리고 인덱스 비용은 Artificial Analysis에서 가져온 것입니다:

노력 Terminal-Bench 4.0 (점수, 시도당 $) FrontierCode v1.1 (점수, 작업당 $) AA 인덱스 (점수, 실행 비용)
낮음 20.0%, $0.76 29.3%, $0.19 35.8, $544
중간 28.8%, $0.83 36.5%, $0.24 40.7, $701
높음 43.0%, $1.94 49.4%, $0.42 46.7, $1,176
매우 높음 61.5%, $5.30 52.1%, $1.59 51.9, $2,738
최대 70.6%, $12.54 46.2%, $20.78 56.0, $8,977

눈에 띄는 점:

최대 노력(max)에서의 장황함은 또 다른 함정입니다. OfficeChai가 작성한 Artificial Analysis 데이터에 따르면 Sonnet 5.5는 최대 노력(max)에서 인덱스 작업당 약 193,000개의 출력 토큰을 사용하며, 작업당 비용은 Sonnet 5보다 약 50% 높습니다. Simon Willison은 Hacker News에서 최대 노력(max-effort) 실행이 128,000개의 '생각' 토큰을 소모하고 답변을 생성하기 전에 중단되었다고 보고했습니다.

비용을 절감하는 6가지 방법

  1. 노력(effort)을 의도적으로 설정하세요. API는 기본적으로 high로 설정되어 있으며, Claude Code와 Claude 앱은 기본적으로 medium으로 설정됩니다. Anthropic의 프롬프트 가이드는 채팅에 medium 또는 low를 권장하며, 측정 가능한 품질 향상을 위해서만 xhigh 또는 max를 사용하라고 제안합니다. Sonnet 5 설정을 그대로 사용하지 마세요. 스케일이 재조정되었습니다.
  2. '생각' 기능을 껐던 곳에 between_tools를 사용하세요. thinking: {"type": "disabled"}는 이제 400 오류를 반환합니다. {"type": "between_tools"}가 low, medium, high에서 이를 대체합니다.
  3. 재사용되는 모든 것을 캐시하세요. 캐시 가능한 최소 프롬프트는 512 토큰입니다 (Sonnet 5에서는 1,024 토큰). 요청 간에 최상위 effort를 변경하면 캐시가 무효화되므로, 이를 일정하게 유지하세요.
  4. 기다릴 수 있는 것은 배치 처리하세요. 입력 및 출력 가격이 절반입니다.
  5. max_tokens를 정직하게 유지하세요. Anthropic의 가이드는 stop_reason: "max_tokens"를 실패한 응답으로 간주하므로, 잘린 답변은 출하할 것이 없는 채로 소모되는 비용입니다.
  6. 요청하지 않은 작업을 줄이세요. Sonnet 5.5는 요청하지 않은 테스트, 문서 및 파일을 추가하고, xhigh 및 max에서 추가 검토 라운드를 시작합니다. Anthropic이 제안한 시스템 프롬프트 문단은 품질 변화 없이 max에서 세션 비용을 약 3분의 1 줄였습니다.

Sonnet 5.5에 대해 다른 곳에서 지불하는 곳

대신 크레딧을 찾고 계신가요? 무료 Claude Sonnet 5.5 API가 있나요를 참조하세요.

Apidog에서 요청당 비용 추적

모든 메시지 응답에는 input_tokens, output_tokens 및 캐시 수를 포함하는 usage 객체가 있습니다. 이것만으로 Apidog에서 모든 호출 가격을 계산하기에 충분합니다:

  1. 키를 ANTHROPIC_API_KEY 환경 변수로 저장하세요.
  2. 동일한 프롬프트로 각 노력 수준(low, medium, high)별로 이 요청을 한 번씩 저장하세요:
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "between_tools"},
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
  }'
  1. 호출 가격을 계산하고 잘림(truncation) 시 실패하는 후처리기를 추가하세요:
const body = pm.response.json();
const u = body.usage;
const cost = (u.input_tokens * 2 + u.output_tokens * 10) / 1e6;
pm.environment.set("last_call_usd", cost.toFixed(5));
pm.test("not truncated", () => pm.expect(body.stop_reason).to.not.eql("max_tokens"));
  1. 세 가지 모두 실행하고 usage.output_tokens와 비용을 나란히 비교하세요. 캐시를 사용하는 경우, 해당 요율로 캐시 수를 추가하세요.

전체 요청 과정은 Claude Sonnet 5.5 API 사용 방법에 있습니다.

자주 묻는 질문 (FAQ)

Claude Sonnet 5.5는 백만 토큰당 얼마인가요? Claude API에서 입력 2달러, 출력 10달러입니다. 캐시 읽기는 0.20달러이며, 배치 API는 1달러와 5달러를 청구합니다.

Sonnet 5.5가 Sonnet 5보다 비싼가요? 아닙니다. 토큰당 가격은 동일하며, Anthropic은 자체 테스트에서 Sonnet 5.5가 작업당 최대 30% 더 저렴하다고 말합니다.

20만 토큰 이상에 대한 추가 요금이 있나요? 아닙니다. 전체 100만 컨텍스트 창은 표준 요율로 청구됩니다.

Sonnet 5.5에 고속 모드가 있나요? 아닙니다. 고속 모드는 Opus 5.5, Opus 5 및 Opus 4.8에서만 사용할 수 있습니다.

Claude Sonnet 5.5는 무료인가요? Claude 채팅 앱에서는 그렇습니다. 누구나 무료 요금제로 채팅할 수 있습니다. API는 선불 크레딧으로 운영되며, 무료 API 가이드에서 크레딧 프로그램을 다룹니다.

다음 단계: 자신의 작업 부하 비용 책정

가장 일반적인 요청 형태 세 가지를 선택하여 각각 두 가지 노력(effort) 수준으로 실행하고, usage 숫자를 위 표에 곱하세요. 그러면 medium이 품질 기준을 충족하는지 또는 high가 추가 토큰 비용을 들일 가치가 있는지 빠르게 확인할 수 있습니다. 해당 요청과 비용 스크립트를 나란히 유지하려면 Apidog를 다운로드하세요.

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요