Claude Opus 5는 2026년 7월 24일에 백만 입력 토큰당 5달러, 백만 출력 토큰당 25달러로 출시되었습니다. 이는 Anthropic이 Opus 4.8에 청구했던 요율과 동일하며, Fable 5 비용의 정확히 절반입니다. 출시 보도는 모두 이 헤드라인을 다루었으며, 그 내용은 사실입니다.
보도에서 빠진 부분은 인보이스를 결정하는 요소들입니다: 캐시 쓰기, 캐시 적중, 배치 요율, 고속 모드, 지역별 승수, 그리고 토큰 수를 조용히 변경하는 동작 변화들입니다. 이 가이드는 전체 가격표를 제공하고, 실제 요청 형태에 대한 비용 계산을 통해 제품 출시 전에 예산을 책정할 수 있도록 돕습니다. 자체 트래픽에 대해 숫자를 확인하려면, Apidog에서 요청을 보내고 모든 응답의 usage 블록을 확인하십시오.
버튼
Claude Opus 5 전체 가격표
아래의 모든 요율은 Anthropic의 가격 책정 문서에서 가져왔으며, 모델 ID claude-opus-5에 적용됩니다.
| 토큰 카테고리 | 백만 토큰당 가격 |
|---|---|
| 입력 (표준) | $5.00 |
| 출력 (표준) | $25.00 |
| 프롬프트 캐시 쓰기, 5분 TTL | $6.25 |
| 프롬프트 캐시 쓰기, 1시간 TTL | $10.00 |
| 캐시 적중 및 갱신 | $0.50 |
| 배치 API 입력 | $2.50 |
| 배치 API 출력 | $12.50 |
| 고속 모드 입력 | $10.00 |
| 고속 모드 출력 | $50.00 |
몇 가지 기억해야 할 사항:
- 캐시 적중은 표준 입력의 10분의 1 비용입니다. 이것이 이 표에서 가장 큰 영향을 미치는 요소입니다.
- 5분 캐시 쓰기는 표준 입력에 비해 1.25배 프리미엄이 붙습니다. 1시간 쓰기는 2배입니다.
- 배치(Batch)는 입력과 출력 모두에서 50% 할인이 적용됩니다.
- 고속 모드는 2.5배 빠른 출력 속도에 대해 정확히 표준 가격의 2배입니다. 이는 연구 미리보기이며, 자체 API 전용입니다(Bedrock, Google Cloud, Microsoft Foundry에서는 사용할 수 없음). 또한 배치 API와 결합되지 않습니다.
- 긴 컨텍스트에 대한 프리미엄은 없습니다. 100만 토큰 컨텍스트 창이 기본이자 최대이며, 어떤 임계값을 넘어서는 토큰도 동일한 5달러로 청구됩니다. 일부 경쟁 모델은 컨텍스트 계층을 넘어서면 더 많은 비용을 청구합니다. Opus 5는 그렇지 않습니다.

마지막 지점은 단일 요청에 대한 상한선을 설정합니다. 가장 비싼 Messages API 호출은 100만 입력 토큰과 128k 출력 최대치($5.00 + $3.20)를 합한 $8.20입니다. output-300k-2026-03-24 베타 헤더를 사용하면 최대 출력이 300k로 증가하는 배치 API에서는 출력 측이 최대 $3.75입니다.
기준점: 4.8과 동일, Fable 5의 절반
Opus 5가 비교할 가능성이 높은 모델들과 어떻게 위치하는지 보여줍니다.
| 모델 | 입력 / 백만 토큰 | 출력 / 백만 토큰 |
|---|---|---|
| Claude Opus 5 | $5.00 | $25.00 |
| Claude Opus 4.8 | $5.00 | $25.00 |
| Claude Fable 5 | $10.00 | $50.00 |
| Claude Sonnet 5 (2026년 8월 31일까지 소개 요금) | $2.00 | $10.00 |
| Claude Sonnet 5 (2026년 9월 1일부터) | $3.00 | $15.00 |
이 표를 통해 두 가지 중요한 점을 읽을 수 있습니다.
첫째, Opus 4.8에서 업그레이드하는 데 토큰당 비용이 들지 않습니다. 요율은 4.5, 4.6, 4.7, 4.8에 걸쳐 동일했습니다. 모델 ID 변경은 단위 경제에 영향을 미치지 않습니다. 하지만 토큰 볼륨은 변경되며, 이는 아래에서 다룰 것입니다. 구형 ID를 사용하는 모든 것에 대해 Opus 4.8 가격 분석은 여전히 유효합니다.
둘째, Opus 5는 Fable 5의 절반 가격입니다. Anthropic의 출시 수치에 따르면 Opus 5는 CursorBench 3.2에서 Fable 5 최고 성능의 0.5% 이내에 들며, OSWorld 2.0에서는 작업당 약 3분의 1의 비용으로 이를 능가한다고 주장합니다. 이는 Opus 5 출시 게시물에 나와 있는 공급업체 자체 수치이며, 2026년 7월 25일 현재 독립적으로 재현된 바는 없습니다. 이들을 확정된 결과가 아닌 주장으로 간주하십시오. Opus 5 vs Fable 5 비교는 가격 차이가 가치 있는 지점을 설명하고, Fable 5 가격 페이지는 더 높은 계층의 세부 정보를 제공합니다.
실제 사례 1: 단일 요청
가장 간단한 형태부터 시작하겠습니다. 8,000개의 입력 토큰과 1,200개의 출력 토큰을 사용하는 요약 호출입니다.
- 입력: 8,000 / 1,000,000 x $5.00 = $0.040
- 출력: 1,200 / 1,000,000 x $25.00 = $0.030
- 총액: 호출당 $0.070
한 달에 10,000번 호출하면 총 $700입니다. Fable 5에서 동일한 작업 부하는 호출당 $0.140, 즉 월 $1,400입니다. Sonnet 5의 소개 요금으로는 호출당 $0.028, 즉 $280입니다.
출력 토큰이 입력 토큰보다 거의 7배 적은 요청에서 출력이 요금의 43%를 차지한다는 점에 유의하십시오. 출력 비용은 입력 비용의 5배이므로, 출력 볼륨이 대부분의 사람들이 예상하는 것보다 빠르게 지배적입니다. 이는 Opus 4.8보다 Opus 5에서 더 중요합니다. 왜냐하면 사고 토큰(thinking tokens)이 출력으로 청구되고 적응형 사고(adaptive thinking)가 이제 기본적으로 활성화되어 있기 때문입니다.
실제 사례 2: 캐싱을 사용한 긴 에이전트 세션
이것이 바로 실제 비용과 실제 절감 효과가 있는 부분입니다. 120,000 토큰 시스템 프롬프트와 저장소 컨텍스트를 사용하는 코딩 에이전트가 40회 턴 세션을 실행한다고 가정해 봅시다. 각 턴은 1,500개의 새로운 대화 토큰을 추가하고 2,500개의 출력 토큰을 생성합니다.
프롬프트 캐싱 없이, 매 턴마다 전체 컨텍스트를 다시 보냅니다:
| 항목 | 토큰 수 | 요율 | 비용 |
|---|---|---|---|
| 입력 (120,000 x 40 + 60,000 신규) | 4,860,000 | $5.00 | $24.30 |
| 출력 (2,500 x 40) | 100,000 | $25.00 | $2.50 |
| 총액 | $26.80 |
120,000 토큰 접두사에 5분 프롬프트 캐시를 사용하면:
| 항목 | 토큰 수 | 요율 | 비용 |
|---|---|---|---|
| 캐시 쓰기, 1회 | 120,000 | $6.25 | $0.75 |
| 캐시 읽기 (39회 턴) | 4,680,000 | $0.50 | $2.34 |
| 새 입력 (1,500 x 40) | 60,000 | $5.00 | $0.30 |
| 출력 (2,500 x 40) | 100,000 | $25.00 | $2.50 |
| 총액 | $5.89 |
이는 78% 감소이며, 이제 출력이 요금의 9% 대신 42%를 차지합니다. 캐싱을 적절히 적용하면, 그 다음으로 최적화할 대상은 출력입니다.
5분 TTL에 대한 한 가지 주의사항: 캐시 읽기는 이를 갱신하므로, 5분 미만의 간격으로 턴이 이어지는 세션은 단일 쓰기로 인해 활성 상태를 유지합니다. 에이전트가 그보다 더 오래 유휴 상태인 경우, 백만 토큰당 10달러인 1시간 쓰기를 사용하십시오. 이 경우 쓰기 비용이 $0.75에서 $1.20으로 증가하고 총액은 $6.34가 되지만, 캐싱하지 않은 실행보다 여전히 76% 저렴합니다.
실제 사례 3: 배치 처리
동기적 응답이 필요 없는 모든 작업에 대해 배치 API는 50% 할인을 제공합니다. 각 1,200개의 입력 토큰과 150개의 출력 토큰을 가진 50,000개의 문서를 처리한다고 가정해 봅시다.
| 경로 | 입력 비용 | 출력 비용 | 총액 |
|---|---|---|---|
| 표준 | 60백만 토큰 x $5.00 = $300.00 | 7.5백만 토큰 x $25.00 = $187.50 | $487.50 |
| 배치 | 60백만 토큰 x $2.50 = $150.00 | 7.5백만 토큰 x $12.50 = $93.75 | $243.75 |
동일한 토큰, 동일한 모델로 $243.75 절약됩니다. 절충점은 품질이 아닌 지연 시간입니다. 분류, 강화 또는 평가 작업이 비동기 전달을 허용한다면, 표준 엔드포인트에서 실행하면 예산의 절반을 낭비하는 셈입니다.
실제 사례 4: 고속 모드의 실제 비용
고속 모드는 약 2.5배 빠른 출력 속도를 위해 요율을 $10/$50로 두 배로 늘립니다. 예제 1의 요청을 고속 모드로 실행하면 0.080달러의 입력과 0.060달러의 출력을 합하여 호출당 $0.140이 되며, 정확히 두 배입니다.
이는 Opus 5의 가격을 Fable 5의 표준 요율과 동일하게 만듭니다: 기능이 아닌 지연 시간에 대해 최고급 가격을 지불하는 것입니다. 사용자가 토큰이 나타나는 것을 보는 인터랙티브한 표면에는 가치가 있지만, 백그라운드 작업에는 정당화하기 어렵습니다. 배치 API와 결합되지 않으므로, 이 두 가지 비용 지렛대는 설계상 상호 배타적입니다.
실제 청구서를 움직이는 네 가지 레버
이 네 가지는 Opus 5에만 해당하며, 얼마나 절약할 수 있는지 구체적으로 알려줍니다.
1. 프롬프트 캐시 최소값이 512토큰으로 감소했습니다.
Opus 4.8에서는 캐시 가능한 최소값이 1,024 토큰이었습니다. Opus 5에서는 512 토큰입니다. 이전에는 너무 짧아서 캐시할 수 없었던 프롬프트도 캐시 제어 블록을 추가하는 것 외에는 코드 변경 없이 캐시할 수 있습니다.
손익분기점 계산은 대부분의 사람들이 예상하는 것보다 좋습니다. 캐시 쓰기 비용은 표준 입력의 1.25배이고, 읽기 비용은 0.1배입니다. 캐싱이 유리한 지점을 계산하면:
- 5분 TTL: 1.3개 요청에서 손익분기점에 도달합니다. 두 번째 호출부터 이득입니다.
- 1시간 TTL: 2.1개 요청에서 손익분기점에 도달합니다. 세 번째 호출부터 이득입니다.
구체적으로, 700 토큰 시스템 프롬프트가 한 번의 버스트에서 1,000번 호출에 재사용될 경우 캐싱하지 않으면 $3.50의 비용이 듭니다. 캐싱하면 쓰기에 $0.0044, 999번의 읽기에 $0.00035씩 추가되어 총 $0.354의 비용이 듭니다. 이 프롬프트는 Opus 4.8에서는 전혀 캐시할 수 없었습니다.
2. 배치(Batch) 50% 할인
위에서 다루었지만, 레버리지로서 다시 언급할 가치가 있습니다: 실제로 동기적 응답이 필요한 작업 부하가 무엇인지 감사하십시오. 평가 실행, 백필, 야간 요약, 콘텐츠 분류는 일반적으로 동기적 응답이 필요하지 않습니다.
3. Effort low 및 medium이 드디어 사용 가능합니다.
output_config.effort는 모델이 얼마나 생각할지 제어하며, 사고 토큰은 백만 토큰당 $25로 출력으로 청구됩니다. Opus 5는 노력 수준을 재조정했으며, Anthropic은 low 및 medium이 이전 Opus 모델보다 의미 있게 더 강력하다고 말합니다. 기본값은 high이며, xhigh는 코딩 및 에이전트 작업에 권장되는 시작점입니다.
절감액은 사고 토큰 볼륨에 비례합니다. 작업이 xhigh에서 평균 8,000개의 사고 토큰을 사용하고 low에서 1,500개를 사용한다면, 6,500개의 출력 토큰 또는 작업당 $0.1625를 절약할 수 있으며, 100,000개 작업에 걸쳐 총 $16,250를 절약하게 됩니다. 이 수치들은 예시일 뿐입니다. 실제 차이는 프롬프트에 따라 달라지므로, Anthropic은 4.8 설정을 그대로 가져오기보다는 자체 평가에 대해 새로운 노력 수준 테스트를 실행할 것을 권장합니다. 노력 매개변수 가이드에서 이 테스트에 대해 다룹니다.
한 가지 함정: 노력 수준을 낮추는 것은 사고 토큰을 줄이는 것이지, 보이는 응답 길이를 줄이는 것이 아닙니다. Opus 5의 기본 응답과 작성된 결과물은 Opus 4.8보다 길며, 노력 수준으로는 이를 해결할 수 없습니다. 더 짧은 답변을 원한다면, 더 짧은 답변을 요청하십시오.
4. 낮은 도구 사용 시스템 프롬프트 오버헤드
도구 정의를 보낼 때 API는 비용을 지불해야 하는 시스템 프롬프트를 삽입합니다. Opus 5에서는 auto 또는 none 도구 선택에 대한 오버헤드가 286 토큰으로, Opus 4.8의 290 토큰과 Opus 4.7의 675 토큰보다 감소했습니다.
이 규모에 대해 솔직해집시다. 4.8과 비교했을 때, 4토큰 차이는 백만 요청당 $20에 불과합니다. 이는 미미한 수준입니다. 4.7과 비교했을 때, 389토큰 차이는 요청당 $0.001945 또는 백만 요청당 $1,945입니다. 4.7을 아직 사용하고 있다면 이는 실제 비용이지만, 4.8에서는 반올림 오차에 불과합니다.
전체 Claude 라인업에 적용되는 레버에 대해서는 Claude API 청구서 절감 가이드에서 더 자세히 다룹니다.
사람들이 놓치는 두 가지 항목
inference_geo: "us" 승수는 1.1배입니다. 규정 준수 또는 데이터 상주를 위해 추론을 미국 전용 인프라에 고정하면 모든 토큰 카테고리에 1.1배가 곱해집니다: 입력 $5.50, 출력 $27.50, 캐시 적중 $0.55, 배치 $2.75 / $13.75. 예제 1의 작업 부하는 월 $700에서 $770으로 증가합니다. $50,000 청구서에서는 $5,000 항목이므로, 설정하기 전에 고정이 필요한지 확인하십시오.
우선순위 계층(Priority Tier)은 Opus 5에서 지원되지 않습니다. Opus 4.8은 이를 유지합니다. 용량 계획이 우선순위 계층 약정에 의존한다면, 이는 전환에 대한 실제 제약이 됩니다. Opus 4.8에서 Opus 5로의 마이그레이션 가이드는 주요 API 변경 사항과 함께 이 내용을 다룹니다.
인보이스에 반영되는 동작 변경 사항
토큰당 요율은 청구서의 절반입니다. 토큰 볼륨은 나머지 절반이며, 세 가지 Opus 5 동작 변경 사항은 아무것도 하지 않으면 볼륨을 증가시킵니다.
- 사고(Thinking)가 기본적으로 활성화됩니다. Opus 4.8에서는
thinking필드가 없는 요청은 사고 과정 없이 실행되었습니다. Opus 5에서는 동일한 요청이 적응형 사고(adaptive thinking)를 실행하며, 해당 토큰은 출력으로 청구됩니다.max_tokens가 사고 및 응답을 함께 제한하므로, 일부 작업 부하는 또한 잘리기 시작할 것입니다. - Opus 5는 하위 에이전트에게 더 쉽게 위임합니다. 각 하위 에이전트는 자체적으로 청구되는 토큰 세트를 가집니다. 비용에 민감한 작업 부하에서는 위임을 제한하거나 범위를 지정하십시오.
- Opus 5는 프롬프트 없이도 자체 작업을 검증합니다. "작업을 다시 확인하세요"와 같은 지침을 그대로 사용했다면, Anthropic의 프롬프트 가이드에서는 이를 제거하라고 말합니다. 과도한 검증은 토큰을 소비합니다.
이 중 어떤 것도 토큰당 가격을 변경하지 않습니다. 모두 지불하는 금액을 변경합니다.
Apidog로 실제 지출 확인
추측을 멈추는 가장 빠른 방법은 모든 응답에서 usage 객체를 읽는 것입니다. 이 객체는 input_tokens, output_tokens, cache_creation_input_tokens, cache_read_input_tokens를 별도로 보고하므로, 위에 제시된 계산을 자체 트래픽과 비교하는 데 필요한 정확한 분석입니다.

Apidog는 API 개발 및 테스트 플랫폼이므로 이 작업을 잘 처리합니다. Messages 엔드포인트에 "model": "claude-opus-5"로 요청을 보낸 다음:
- 저장된 요청을 각 노력 수준별로 한 번씩 복제하고, 동일한 프롬프트에서 사고 토큰 볼륨을 나란히 비교합니다.
usage.cache_read_input_tokens가 0보다 큰지 확인하여, 조용히 손상된 캐시가 예상치 못한 청구서 대신 실패하는 테스트로 나타나도록 합니다.- 키를 요청 본문이 아닌 환경 변수로 저장하여, 개발 키가 프로덕션 규모의 배치를 실행하지 않도록 합니다.
- SSE 스트림을 모니터링하여 긴 생성 과정에서 출력 토큰이 어디로 가는지 확인합니다.
Apidog를 다운로드하여 Opus 5 API 가이드의 안내와 함께 이 검사들을 실행하십시오.
5달러 / 25달러로 실제로 얻는 것
Opus 5는 강력한 가격 대비 성능 위치를 차지하지만, Claude 스택의 최상위는 아닙니다. Fable 5는 Anthropic에서 가장 널리 출시된 모델로 남아 있으며, Opus 5는 사이버 보안 익스플로잇 및 자율 생물학 연구 분야에서 여전히 Mythos 5에 뒤처집니다. Anthropic은 이 두 가지를 분명히 밝힙니다. 솔직한 표현은 최첨단급 기능을 최첨단 가격의 절반으로 제공하며, 그 위에 명명된 상한선이 있다는 것입니다. 저희의 Mythos 등급 설명은 그 선 위에 무엇이 있는지 다룹니다.
대부분의 팀에게 진정한 질문은 Opus 5 대 최고 성능 모델이 아닙니다. 작업 부하에 Opus가 전혀 필요한지, 아니면 Sonnet 5가 ($2/$10, 2026년 9월 1일부터 $3/$15로 인상) 40% 가격으로 작업을 수행할 수 있는지 여부입니다. 예산을 확정하기 전에 자체 평가를 통해 두 모델을 모두 실행해 보십시오. 전체 사양 및 가용성은 Claude Opus 5 개요에 있으며, Anthropic의 모델 개요에는 정식 표가 있습니다.
자주 묻는 질문
Claude Opus 5는 얼마입니까? 표준 API에서 백만 입력 토큰당 5달러, 백만 출력 토큰당 25달러입니다. 캐시 적중은 $0.50, 배치 실행은 $2.50 / $12.50, 고속 모드는 $10 / $50입니다.
Claude Opus 5가 Opus 4.8보다 비쌉니까? 토큰당 가격은 동일하므로 아닙니다. 하지만 사고(thinking)가 기본적으로 활성화되고 기본 응답이 더 길어지기 때문에 청구서가 여전히 늘어날 수 있습니다. 동일하다고 가정하기보다는 토큰 볼륨을 측정하십시오.
100만 토큰 창에 긴 컨텍스트 추가 요금이 있습니까? 아니요. 100만 토큰 컨텍스트 창은 기본이자 최대이며, 긴 입력에 대한 프리미엄 계층은 없습니다.
Claude Opus 5를 실행하는 가장 저렴한 방법은 무엇입니까? 캐시를 적극적으로 사용하고(512 토큰 최소값은 거의 모든 재사용되는 접두사가 해당됨을 의미), 중요하지 않은 작업은 배치 API를 통해 50% 할인된 가격으로 실행하며, 자체 평가를 통과하는 가장 낮은 노력 수준을 찾으십시오. 무료 및 최저 비용 경로 가이드에 더 많은 정보가 있습니다.
지역 고정(regional pin)에 추가 비용이 듭니까? 예. inference_geo: "us"를 설정하면 캐시 적중 및 배치를 포함한 모든 토큰 카테고리에 1.1배의 승수가 적용됩니다.
