클로드 페이블 5.1 가격: 전체 비용 상세 분석 (2026)

클로드 페이블 5.1 가격: MTok당 $10/$50, 캐시 읽기 $0.25 (페이블 5 대비 75% 저렴), 배치 요율, 그리고 25% 및 45% 절감 주장 이면의 비용 계산.

INEZA Felin-Michel

INEZA Felin-Michel

2 September 2026

클로드 페이블 5.1 가격: 전체 비용 상세 분석 (2026)

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

Claude Fable 5.1은 Fable 5와 동일하게 인풋 토큰 100만 개당 10달러, 아웃풋 토큰 100만 개당 50달러입니다. 변경 사항은 프롬프트 캐시 읽기 비용입니다. Fable 5의 100만 토큰당 1달러에서 0.25달러로, Opus 5의 0.50달러의 절반으로 내려갔습니다. Anthropic은 이로 인해 일반적인 워크로드가 Fable 5보다 약 25% 저렴해지고, 고도로 에이전트화된 워크로드는 최대 약 45%까지 저렴해질 것으로 추정합니다.

이 가이드는 공식 가격 페이지의 모든 요금을 제시하고, 사용자의 캐시 적중률을 대입해 볼 수 있도록 25% 및 45% 할인 주장을 재현하며, 세 가지 실제 작업당 비용 예시를 제시하고, 요금에 영향을 미치는 요소들을 나열합니다. 모델 개요를 먼저 알고 싶다면 Claude Fable 5.1이란 무엇인가를 읽어보세요.

Claude Fable 5.1 가격표

요금 Claude Fable 5.1
기본 입력 100만 토큰당 10달러
출력 100만 토큰당 50달러
5분 캐시 쓰기 100만 개당 12.50달러 (입력의 1.25배)
1시간 캐시 쓰기 100만 개당 20달러 (입력의 2배)
캐시 읽기 (적중 또는 새로고침) 100만 개당 0.25달러 (입력의 0.025배)
배치 API 입력 100만 개당 5달러
배치 API 출력 100만 개당 25달러
긴 컨텍스트 프리미엄 없음; 전체 1M 윈도우는 표준 요금으로 청구됩니다
inference_geo: "us" 모든 토큰 카테고리에 1.1배
고속 모드 사용 불가 (Opus 5 및 Opus 4.8만 해당)
우선순위 티어 지원되지 않음
웹 검색 검색 1,000회당 10달러 + 토큰 비용

Claude Mythos 5.1은 동일한 요금입니다. 배치 할인과 캐시 승수는 중첩되어, 배치된 캐시 읽기는 100만 개당 0.125달러가 됩니다.

캐시 읽기 가격 비교

모델 기본 입력 캐시 읽기 입력 대비 캐시 읽기 비율
Claude Fable 5.1 $10 $0.25 2.5%
Claude Fable 5 $10 $1.00 10%
Claude Opus 5 $5 $0.50 10%
Claude Opus 4.8 $5 $0.50 10%
Claude Sonnet 5 $2 $0.20 10%
Claude Haiku 4.5 $1 $0.10 10%

다른 모든 Claude 모델은 캐시 적중 비용을 기본 입력의 10%로 책정합니다. Fable 5.1은 2.5%로 책정합니다. 실제 효과: Fable 5.1의 캐시되지 않은 입력이 두 배 비싸더라도 Fable 5.1 캐시 적중은 Opus 5 캐시 적중보다 저렴합니다. 대부분의 입력 토큰이 캐시된 접두사인 워크로드의 경우, Fable 5.1의 유효 입력 요금은 Opus 5보다 낮아질 수 있습니다.

Sonnet 5에 대한 참고 사항으로, Opus 5와 Sonnet 5 비교에서 9월 가격 인상이 언급되었으나, Anthropic이 이를 취소했습니다. Sonnet 5는 2달러와 10달러를 유지합니다.

25% 및 45% 할인 주장 재현

Anthropic은 이러한 추정치의 배경이 되는 워크로드 조합을 공개하지 않았으므로, 이는 정확한 모델이라기보다는 그들이 암시하는 캐시 적중률을 보여주는 재구성으로 이해해야 합니다.

요청에 U개의 캐시되지 않은 입력 토큰, C개의 캐시된 입력 토큰, O개의 출력 토큰이 있다고 가정해 봅시다. Fable 5의 100만 개당 비용은 10U + 1.0C + 50O이며, Fable 5.1에서는 10U + 0.25C + 50O입니다. 절약액은 0.75C이며, 절약률은 0.75C / (10U + C + 50O)입니다.

일반적인 채팅 스타일 워크로드. 요청당 20,000개의 캐시된 토큰, 2,000개의 캐시되지 않은 입력 토큰, 1,500개의 출력 토큰이 있다고 가정해 봅시다. Fable 5: 10(0.002) + 1.0(0.02) + 50(0.0015) = 0.02달러 + 0.02달러 + 0.075달러 = 0.115달러. Fable 5.1: 0.02달러 + 0.005달러 + 0.075달러 = 0.100달러. 절약: 13%. Anthropic의 25%를 달성하려면 출력에 비해 캐시된 비율이 더 커야 합니다. 예를 들어, 동일한 1,500개의 출력 토큰에 대해 60,000개의 캐시된 토큰을 사용하면 0.155달러 대 0.110달러로 29% 절약됩니다.

에이전트 루프. 40번의 도구 호출마다 150,000개의 캐시된 접두사를 다시 읽고, 턴마다 1,000개의 캐시되지 않은 토큰을 추가하며, 턴마다 800개의 출력 토큰을 생성하는 에이전트입니다. Fable 5에서 턴당: 10(0.001) + 1.0(0.15) + 50(0.0008) = 0.01달러 + 0.15달러 + 0.04달러 = 0.20달러. Fable 5.1에서: 0.01달러 + 0.0375달러 + 0.04달러 = 0.0875달러. 절약: 턴당 56%, 일회성 캐시 쓰기 비용 제외. 40턴 동안 8.00달러 대 3.50달러입니다. Anthropic의 "최대 45%"는 실제 모든 에이전트가 가지고 있는 캐시 쓰기 및 캐시되지 않은 턴을 추가하면 이 범위 안에 편안하게 들어갑니다.

도출되는 규칙: 절약은 캐시된 입력과 출력의 비율에 비례합니다. 출력 중심 워크로드(짧은 프롬프트에서 긴 생성)는 변화를 거의 느끼지 못합니다. 접두사 중심 워크로드(에이전트, 큰 안정적인 컨텍스트를 가진 RAG, 다중 턴 지원 봇)는 전체 효과를 누립니다.

작업당 비용 예시 3가지

세 가지 예시 모두 Fable 5.1의 표준 요금을 가정하며, 5분 캐시 쓰기 비용은 한 번 지불됩니다.

1. 단일 코드 검토. 30,000개 입력 토큰 (diff + 시스템 프롬프트), 4,000개 출력 토큰, 캐시 없음. 입력 0.30달러, 출력 0.20달러. 총액: 0.50달러. Opus 5에서의 동일한 검토는 0.25달러입니다. 캐시된 것이 없으므로 Fable 5.1이 단순히 두 배 비싼 경우입니다.

2. 25턴 지원 대화. 12,000개의 안정적인 시스템 프롬프트가 한 번 캐시되고 (쓰기 비용 0.15달러), 그 다음 25턴 동안 각 턴마다 300개의 캐시되지 않은 입력 토큰과 250개의 출력 토큰을 추가하며, 접두사는 캐시에서 제공됩니다. 대화 전체의 캐시되지 않은 입력: 7,500 토큰 = 0.075달러. 캐시 읽기: 25 x 12,000 = 300,000 토큰 = 0.075달러. 출력: 6,250 토큰 = 0.3125달러. 총액: 약 0.61달러. Fable 5에서는 캐시 읽기만 0.30달러였으므로 총액은 약 0.84달러였습니다.

3. 두 시간 에이전트 빌드. 접두사가 20,000개에서 200,000개 토큰으로 증가하는 (평균 110,000개 캐시된) 접두사에 대해 120번의 도구 호출 턴, 턴당 1,500개의 캐시되지 않은 토큰, 턴당 1,200개의 출력 토큰, 그리고 접두사가 증가함에 따라 약 6번의 캐시 새로고침이 발생합니다. 캐시 읽기: 120 x 110,000 = 1,320만 토큰 = 3.30달러. 캐시되지 않은 입력: 180,000 토큰 = 1.80달러. 출력: 144,000 토큰 = 7.20달러. 캐시 쓰기: 대략 660,000 토큰에 12.50달러 = 8.25달러. 총액: 약 20.55달러. Fable 5에서는 캐시 읽기 비용이 3.30달러 대신 13.20달러였으므로, 총액은 약 30.45달러였습니다. 이는 출력이 여전히 가장 큰 비용 항목인 실행에서 33%의 절감 효과입니다.

예시 3에서 캐시 쓰기 비용이 이제 두 번째로 큰 비용임을 주목하세요. 이는 저렴한 읽기 비용의 이면입니다. 캐시 미스는 캐시 적중보다 40배 비싸므로, 세션 중간에 캐시를 재설정하는 모든 작업(시스템 프롬프트 재구축, 이전 턴 편집, 도구 배열 변경)은 Fable 5에서보다 안정적인 상태에 비해 훨씬 더 많은 비용이 듭니다.

요금에 영향을 미치는 요소들

노력(Effort). output_config.effort는 출력 토큰에 대한 가장 큰 단일 요소이며, 출력 비용은 100만 개당 50달러입니다. Anthropic은 Fable 5.1에 대해 high에서 시작할 것을 권장하며, medium은 Fable 5 품질과 비슷한 수준으로 더 낮은 비용을 제공하고, low는 작업당 비용 측면에서 Opus 및 Sonnet과 경쟁력이 있다고 주장합니다. 자체 평가를 통해 스윕을 실행하세요. 메시지당 effort 베타 기능을 사용하면 캐시 재설정 없이 일반적인 턴에서는 low로 낮추고 어려운 턴에서는 높일 수 있습니다.

캐시를 따뜻하게 유지하세요. 프롬프트 캐싱이 할인입니다. 읽기 비용이 0.25달러이고 쓰기 비용이 12.50달러일 때, 5분 TTL의 손익분기점은 한 번의 적중입니다. 5분에서 60분 사이의 유휴 간격 동안에는 5분 TTL에 대해 max_tokens: 0으로 유지되는 재전송이 1시간 TTL에 대한 2배 쓰기 비용을 지불하는 것보다 일반적으로 저렴합니다. 그리고 이 모델에서 사고 블록을 보존하는 동일한 추가 전용 규칙이 캐시를 보존합니다. 세션 중간에 system 또는 tools를 재구축하지 말고, 변경 사항에는 대화 중간 시스템 메시지를 사용하고, 턴당 알림에는 턴 범위 메시지를 사용하세요.

기다릴 수 있는 것은 배치 처리하세요. 배치 API는 모든 비용을 절반으로 줄여주므로, Fable 5.1 배치 요청은 5달러와 25달러로 Opus 5의 동기식 가격과 동일합니다. 평가, 백필, 야간 문서 처리는 여기에 해당됩니다. 배치에서는 fallbacks가 거부되므로, 거부된 항목은 수동으로 다시 제출해야 합니다.

경로별 티어를 선택하세요. Anthropic 자체 문서에서는 Opus 5에서 시작하여, 더 높은 effort의 Opus 5도 부족할 때 Fable 5.1로 전환하라고 권고합니다. Opus 5가 평가를 통과하는 경로에서는 아무것도 얻지 못한 채 두 배의 비용을 지불하게 됩니다. Fable 5.1과 Opus 5 비교는 워크로드별 결정에 대해 설명합니다.

도구 오버헤드를 주시하세요. 도구가 포함된 모든 요청에는 숨겨진 도구 사용 시스템 프롬프트가 포함됩니다. Anthropic은 Opus 5에 대한 토큰 수(286개 토큰)를 공개했지만, Fable 5.1 수치는 아직 공개하지 않았으므로 토큰 계산 엔드포인트를 사용하여 측정해야 합니다. 브라우저 도구 세트는 요청당 약 6,600개의 토큰을 추가하고, 컴퓨터 도구 세트는 약 4,500개의 토큰을 추가하며, 이 모든 토큰은 첫 전송 후에 캐시됩니다.

거절은 무료, 재시도는 유료. 출력이 생성되기 전 분류기 거절은 요금이 청구되지 않습니다. 서버 측 폴백은 재시도에 대해 폴백 모델의 요금을 청구하며, Anthropic의 폴백 크레딧은 전환에 따른 캐시 비용을 환불해 줍니다. Fable 5.1 지출 중 얼마가 Opus 5에서 처리되는지 알 수 있도록 거절을 별도의 지표로 측정하세요.

저희 Claude API 청구서 절감 가이드에 있는 대부분의 일반적인 기술은 여전히 적용되며, Fable 5.1에 유리하게 캐시 읽기 계산 방식이 변경되었습니다.

Fable 5.1에서 얻을 수 없는 것

고속 모드는 Opus 5와 Opus 4.8에만 해당하며, 10달러와 50달러입니다. Fable 5.1에서 더 빠른 출력을 위해 비용을 지불할 방법은 없습니다. Priority Tier는 Fable 5.1 또는 Mythos 5.1에서 지원되지 않지만 Fable 5는 지원하므로, 여기에 의존하는 기업의 용량 계획은 Fable 5를 유지하거나 Opus 5로 전환해야 합니다. 그리고 Anthropic이 명시적으로 승인하지 않는 한 제로 데이터 보존(ZDR)은 제공되지 않습니다. ZDR 조직은 모든 요청에서 400 오류를 받습니다.

Apidog에서 실제 지출 확인하기

요청 비용을 아는 유일하고 신뢰할 수 있는 방법은 usage 객체이며, 이를 가장 빠르게 읽는 방법은 테스트 컬렉션을 사용하는 것입니다. Apidog에서 프로덕션 시스템 프롬프트를 cache_control을 설정한 요청으로 저장하고, 두 번 전송한 다음, 첫 번째 전송에 대해 usage.cache_creation_input_tokens에, 두 번째 전송에 대해 usage.cache_read_input_tokens에 어설션을 추가하세요. 그런 다음 각 필드를 해당 요금으로 곱하고 요청당 비용을 기록하는 응답 후 스크립트를 추가하세요. 프롬프트나 도구 정의를 변경할 때마다 컬렉션을 실행하면, 청구서에 반영되기 전에 캐시를 깨뜨리는 편집을 잡아낼 수 있습니다. 이를 구축하려면 Apidog를 다운로드하세요. API 둘러보기에서 정확한 요청을 확인할 수 있습니다.

Claude 앱에서의 Fable 5.1 가격

API 가격은 토큰당입니다. Claude 앱에서는 Fable 5.1이 플랜에 따라 측정됩니다. Max 플랜은 주간 사용량 한도의 최대 50%까지 Fable 모델을 추가 비용 없이 포함하며, 그 이후에는 사용 크레딧으로 계속됩니다. Pro 및 표준 팀 계정은 첫 메시지부터 사용 크레딧을 통해 Fable 5.1을 측정합니다. Enterprise 표준 계정은 플랜 한도를 초과하여 사용하려면 사용 크레딧이 활성화되어야 하며, 사용량 기반 Enterprise는 표준 API 요금으로 청구됩니다. 안전장치가 다른 모델로 리디렉션하는 요청은 Fable 가격으로 청구되지 않습니다. 무료 및 최저 비용 경로 가이드에서 이것이 실제로 무엇을 의미하는지 설명합니다.

자주 묻는 질문 (FAQ)

Claude Fable 5.1은 100만 토큰당 얼마인가요? Fable 5와 동일하게 입력 10달러, 출력 50달러입니다. 캐시 읽기는 100만 개당 0.25달러, 캐시 쓰기는 12.50달러(5분) 및 20달러(1시간)이며, 배치 API는 5달러 및 25달러입니다.

Claude Fable 5.1이 Fable 5보다 저렴한가요? 토큰당 가격은 아닙니다. 실제로는 프롬프트 캐싱을 사용하는 모든 경우에 저렴합니다. 캐시 읽기 비용이 100만 개당 1달러에서 0.25달러로 떨어졌기 때문입니다. Anthropic은 일반적인 워크로드에서 25%, 에이전트 워크로드에서 최대 45% 저렴하다고 추정합니다. 출력 중심 워크로드는 변화가 거의 없습니다.

Claude Fable 5.1이 Opus 5보다 저렴한가요? 캐시되지 않은 경우에는 아닙니다. 정확히 두 배 비쌉니다. 캐시된 경우에는 상황이 달라집니다. Fable 5.1 캐시 적중(0.25달러)은 Opus 5 캐시 적중(0.50달러)의 절반 비용입니다. 출력 비용은 여전히 50달러 대 25달러이므로, 출력 중심 경로에서는 Opus 5가 더 유리합니다.

Claude Fable 5.1에 고속 모드 또는 우선순위 티어가 있나요? 둘 다 없습니다. 고속 모드는 Opus 5와 Opus 4.8에만 해당합니다. 우선순위 티어는 Fable 5에서는 지원되지만 Fable 5.1에서는 지원되지 않습니다.

Claude Fable 5.1에 긴 컨텍스트 프리미엄이 있나요? 없습니다. 전체 1M 토큰 윈도우는 표준 요금으로 청구되며, 캐시 및 배치 할인이 적용됩니다.

Bedrock 또는 Google Cloud에서 Claude Fable 5.1은 얼마인가요? 해당 플랫폼은 자체 가격을 설정하며 지역 엔드포인트에 10% 프리미엄을 추가합니다. AWS의 Claude Platform과 Microsoft Foundry는 Claude Consumption Units를 통해 표준 API 요금으로 청구합니다. 저희 클라우드 가용성 가이드에서 각 설정에 대해 다룹니다.

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요