Claude Fable 5.1은 백만 토큰당 10달러와 50달러입니다. Claude Opus 5는 5달러와 25달러입니다. Anthropic 자체 문서에서는 Claude Opus 5의 고강도 평가에서 여전히 부족함이 있을 때만 Opus 5로 시작하여 Fable 5.1로 전환하라고 명시하고 있습니다. 이는 테스트 가능한 규칙이며, 이 비교는 이를 중심으로 이루어집니다. Anthropic의 수치에서 Fable 5.1이 Opus 5를 능가하는 부분, 프롬프트 튜닝으로 격차를 좁힐 수 있는 몇 가지 지점, 그리고 Fable 5.1의 캐시 읽기 비용이 Opus 5의 절반이기 때문에 가격 계산이 흥미로워지는 지점들을 다룹니다.
출처는 Anthropic의 출시 게시물, Fable 5.1 모델 페이지, 그리고 가격 페이지입니다. 각 모델에 대한 자세한 내용은 Claude Fable 5.1이란 무엇인가 및 Claude Opus 5란 무엇인가를 참조하십시오.
나란히 비교
| Claude Fable 5.1 | Claude Opus 5 | |
|---|---|---|
| 모델 ID | claude-fable-5-1 |
claude-opus-5 |
| 출시일 | 2026년 9월 1일 | 2026년 7월 24일 |
| 포지셔닝 | 까다로운 추론 및 장기적인 에이전트 작업 | 복잡한 에이전트 코딩 및 엔터프라이즈 작업; 권장 기본값 |
| 입력 / 출력 | $10 / $50 | $5 / $25 |
| 캐시 읽기 | $0.25 | $0.50 |
| 캐시 쓰기 (5분 / 1시간) | $12.50 / $20 | $6.25 / $10 |
| 배치 | $5 / $25 | $2.50 / $12.50 |
| 고속 모드 | 아니요 | 예 ($10 / $50) |
| 우선순위 티어 | 아니요 | 아니요 |
| 컨텍스트 / 최대 출력 | 1M / 128K | 1M / 128K (베타 버전의 배치에서 300K) |
| 지식 업데이트 시점 | 2026년 6월 | 2026년 5월 |
| 비교 지연 시간 | 더 느림 | 보통 |
| 사고 과정 | 항상 켜짐; disabled 시 400 반환 |
기본적으로 켜짐; high 또는 그 이하에서 disabled 허용 |
강제 tool_choice |
400 | 허용됨 |
| 안전 분류기 | 사이버, 생체, 프론티어 LLM, 추론 추출, 일반 유해성 | 사이버 전용 |
| 제로 데이터 보존 | 승인되지 않은 경우 사용 불가 | 사용 가능 |
| 메시지당 노력 (베타) | 예 | 예 |
| 기록 편집 확인 | 예 | 아니요 |
벤치마크 결과
모든 수치는 Anthropic에서 Anthropic이 실행한 것으로, 아직 독립적인 재현은 이루어지지 않았습니다.
| 벤치마크 | Fable 5.1 | Opus 5 | 격차 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 29.0% | +23.6 |
| AutomationBench | 31.4% | 26.9% | +4.5 |
| 인류 최후의 시험 (도구 없음) | 60.9% | 56.6% | +4.3 |
| Terminal-Bench 4.0 | 55.8% | 52.3% | +3.5 |
| CursorBench 3.2.0 | 73.4% | 70.0% | +3.4 |
| OSWorld 2.0 (부분) | 77.9% | 75.4% | +2.5 |
| OSWorld 2.0 (엄격) | 41.7% | 39.6% | +2.1 |
| 인류 최후의 시험 (도구 포함) | 65.0% | 63.6% | +1.4 |
| GDPval-AA v2 | 1853 | 1824 | +29 Elo |
이 표를 두 가지 이야기로 읽어보십시오. Terminal-Bench-Science에서 Fable 5.1은 Opus 5를 거의 두 배로 능가하는데, 이는 모델이 터미널에서 오랜 시간 동안 실험을 수행하는 장기적이고 도구 의존적인 연구 벤치마크입니다. 그 외의 모든 벤치마크에서는 격차가 1점에서 5점 사이입니다. AutomationBench에서의 5점 차이는 의미 있는 격차입니다. 도구 사용 인류 최후의 시험에서 1.4점 차이나 GDPval에서 29 Elo 차이는 모델 선택보다 프롬프트와 노력 설정이 결과에 더 큰 영향을 미치는 범위 내에 있습니다.
기억해야 할 또 다른 데이터는 다음과 같습니다. Opus 5는 7월에 Terminal-Bench 4.0에서 52.3%로 출시되어 Fable 5의 42.0%보다 앞섰습니다. Fable 5.1은 55.8%로 다시 선두를 차지했지만, 13.8점이 아닌 3.5점 차이였습니다. 에이전트 코딩에서 Fable 티어가 Opus 티어에 비해 가지는 이점은 실제이며 6월보다 좁아졌습니다. Opus 5 대 Fable 5 비교는 이 경쟁의 초기 상태를 보여줍니다.

가격 계산이 단순히 2배인 것은 아닙니다
캐시되지 않은 경우, Fable 5.1은 모든 면에서 Opus 5의 정확히 두 배입니다. 하지만 캐시 읽기 비용은 반대입니다: Fable 5.1은 0.25달러인 반면 Opus 5는 0.50달러입니다. 따라서 실제 곱셈 값은 입력 중 캐시된 접두사가 얼마나 되는지에 따라 달라집니다.
150,000개의 캐시된 토큰, 1,000개의 캐시되지 않은 입력 토큰, 800개의 출력 토큰을 사용하는 에이전트 턴을 가정해 봅시다. Opus 5: 5(0.001) + 0.5(0.15) + 25(0.0008) = 0.005달러 + 0.075달러 + 0.02달러 = 0.10달러. Fable 5.1: 10(0.001) + 0.25(0.15) + 50(0.0008) = 0.01달러 + 0.0375달러 + 0.04달러 = 0.0875달러. 이 턴에서는 Fable 5.1이 더 저렴합니다.
이제 30,000개의 캐시되지 않은 입력 토큰과 4,000개의 출력 토큰을 사용하는 코드 검토를 가정해 봅시다. Opus 5: 0.15달러 + 0.10달러 = 0.25달러. Fable 5.1: 0.30달러 + 0.20달러 = 0.50달러. 정확히 두 배입니다.
교차 지점: Fable 5.1의 턴당 비용은 캐시된 입력 토큰이 캐시되지 않은 입력 토큰 합계의 약 20배와 출력 토큰의 5배를 초과할 때 Opus 5보다 낮아집니다. 접두사가 많은 에이전트 루프의 경우 이러한 조건이 일반적입니다. 출력량이 많은 경우에는 결코 발생하지 않습니다. Fable 5.1의 캐시 쓰기 비용도 두 배이므로 캐시를 자주 재설정하는 세션은 이점을 잃을 수 있습니다. Fable 5.1 가격 분석 및 Opus 5 가격 분석에 전체 표가 나와 있습니다.
Opus 5가 확실히 우위를 점하는 곳
- 사고 기능을 끈 상태로 실행할 수 있는 모든 것. Opus 5는 `high` 노력 수준 이하에서 `thinking: {"type": "disabled"}`를 허용합니다. Fable 5.1은 절대 허용하지 않습니다. 분류, 추출 및 단답형 경로의 경우, 사고 기능을 끈 상태 (또는 `low` 노력 수준)의 Opus 5는 더 저렴하고 더 빠릅니다.
- 고속 모드. Opus 5는 10달러와 50달러로 최대 2.5배 빠른 출력 속도를 제공하는 연구 미리보기 고속 모드를 가지고 있습니다. Fable 5.1에는 이에 상응하는 기능이 없습니다. 응답 시간이 몇몇 벤치마크 점수보다 더 중요하다면, 이는 결정적인 요소입니다.
- 일반적인 지연 시간. Anthropic은 Fable 5.1을 "더 느림"으로, Opus 5를 "보통"으로 분류합니다. 고난이도 작업에서 고강도 노력으로 Fable 5.1의 단일 턴은 수 분이 걸릴 수 있습니다.
- 제로 데이터 보존. Opus 5는 ZDR(Zero Data Retention) 하에서 사용 가능합니다. Fable 5.1은 Covered Model이며 Anthropic이 ZDR 액세스를 명시적으로 승인하지 않는 한 400 오류를 반환합니다.
- 더 적은 거부. Opus 5는 사이버 보안 전용 분류기를 실행합니다. Fable 5.1은 전체 Fable 세트(사이버, 생체, 프론티어 LLM 개발, 추론 추출 및 일반 유해성)를 실행합니다. Opus 5에서는 문제가 되지 않는 양성 생명 과학 또는 ML 워크로드가 Fable 5.1에서는 문제가 될 수 있으며, 그럴 경우에도 대체 대상은 Opus 5입니다.
- 강제 도구 사용. Opus 5는 여전히 `tool_choice` `any` 및 `tool`을 허용합니다. Fable 5.1은 400 오류를 반환합니다. 통합이 강제 호출에 의존하는 경우, Opus 5는 재작성을 절약해 줍니다.
- 기록 편집 확인 없음. Opus 5는 이전 턴을 편집해도 신경 쓰지 않습니다. Fable 5.1은 편집 시 이후 사고 블록을 무효화합니다. 클라이언트 측에서 압축하거나 턴당 알림을 주입하는 하네스는 현재 Opus 5에서 작동하지만 Fable 5.1을 사용하기 전에 감사가 필요합니다.
Fable 5.1이 확실히 우위를 점하는 곳
- 장기 연구 및 터미널 에이전트. Terminal-Bench-Science에서 52.6% 대 29.0%의 결과는 Anthropic 표에서 가장 큰 단일 격차입니다. 에이전트가 실험을 실행하거나, 다단계 웹 연구를 추구하거나, 몇 시간 동안 작동하는 경우, 이 모델은 이러한 워크로드를 위해 만들어졌습니다.
- 비즈니스 워크플로우 자동화. AutomationBench에서 31.4% 대 26.9%는 애플리케이션 전반의 엔드투엔드 작업을 모델링하는 벤치마크에서 실제적인 격차입니다.
- 캐시 접두사가 많은 에이전트. 위에서 다루었듯이, 0.25달러의 캐시 읽기 비용은 접두사가 지배적인 루프에서 Fable 5.1을 턴당 더 저렴하게 만듭니다.
- 지식 업데이트 시점. 2026년 6월 대 2026년 5월. 한 달 차이지만, 모든 Claude 모델 중 가장 최신입니다.
- 밀도 높은 문서에서의 시각 기능. Anthropic은 PDF에 포함된 차트, 문서, 표의 읽기 기능 향상, 특히 자르기 및 확대/축소 도구를 사용했을 때의 개선을 Fable 5.1의 이점 영역으로 꼽습니다. Opus 5는 공개된 시각 벤치마크에서 비교되지 않았으므로, 이는 테스트해야 할 주장으로 간주하십시오.
- `xhigh` 노력 수준의 Opus 5가 실패할 때. 이것은 Anthropic의 규칙이며 올바른 규칙입니다. `xhigh` 노력 수준의 Opus 5에서 작업 평가가 실패하면, 다른 것을 시도하기 전에 `high` 노력 수준의 Fable 5.1을 시도해 보십시오.
노력 수준에 따라 비교가 달라집니다
두 모델 모두 다섯 가지 노력 수준을 제공하며, Anthropic은 Fable 5.1의 낮은 노력 수준에 대해 다음과 같은 구체적인 주장을 합니다: `low` 노력 수준에서 "작업당 비용 면에서 Claude Opus 및 Claude Sonnet 모델과 경쟁력이 있으며 더 높은 점수를 얻는다"는 것입니다. 이는 선택의 틀을 바꿉니다. `high` 노력 수준의 Opus 5와 `high` 노력 수준의 Fable 5.1을 비교하는 대신, 일상적인 작업에 대한 공정한 비교는 `high` 노력 수준의 Opus 5와 `low` 또는 `medium` 노력 수준의 Fable 5.1일 수 있습니다. 낮은 노력 수준에서 출력 토큰 수가 적어 토큰당 2배의 가격을 상쇄합니다.
그 반대도 마찬가지입니다. Fable 5.1이 Fable 5에 비해 얻는 이점은 `xhigh` 및 `max`에서 가장 크며, 이는 Opus 5 이상의 기능 한계가 가장 많은 시간을 소모하는 노력 수준에서 가장 높다는 것을 의미합니다. 출시 표에서 어떤 결론을 내리기 전에 자신의 평가에서 두 모델의 노력 수준을 모두 확인해 보십시오. Opus 5 노력 가이드에는 다섯 가지 수준이 설명되어 있으며, Fable 5.1에서도 의미는 동일합니다.
의사결정 프레임워크
- `high` 노력 수준의 Opus 5로 시작하십시오. Anthropic의 기본 권장 사항이며, 가격은 절반이고 분류기가 적으며 ZDR을 사용할 수 있습니다.
- 실패하는 작업에 대해 Opus 5를 `xhigh` 노력 수준으로 올리십시오. 모델을 전환하는 것보다 저렴합니다.
- 여전히 실패하는 작업을 `high` 노력 수준의 Fable 5.1로 이동하십시오. 전역적으로가 아니라 경로별로. 통과하는 모든 것에는 Opus 5를 유지하십시오.
- 이동한 작업의 캐시 프로필을 확인하십시오. 접두사가 많은 루프인 경우, Fable 5.1이 Opus 5보다 턴당 비용이 더 저렴할 수 있습니다.
- 3단계 전에 하네스를 감사하십시오. 강제 `tool_choice`와 기록 편집은 모두 Fable 5.1에서 작동하지 않습니다. 마이그레이션 가이드에 체크리스트가 있습니다.
Apidog에서 비교 실행하기
프로덕션 프롬프트와 `model`을 환경 변수로 사용하여 컬렉션을 하나 만드십시오. `high` 노력 수준의 `claude-opus-5`에 대해 실행하고, 다시 `xhigh` 노력 수준에 대해 실행한 다음, `high` 및 `low` 노력 수준의 `claude-fable-5-1`에 대해 실행하십시오. 각 실행에 대해 반복 전송 시 응답, `usage.output_tokens` 및 `usage.cache_read_input_tokens`를 기록하십시오. 응답 후 스크립트에서 각 모델의 요율을 곱하면 하나의 표에서 노력 수준별 모델별 작업당 비용을 얻을 수 있습니다. Apidog는 모든 실행을 기록으로 유지하므로, 다음 모델 출시 이후에도 비교를 유지할 수 있습니다. Apidog를 다운로드하여 설정하십시오.
자주 묻는 질문 (FAQ)
Claude Fable 5.1이 Opus 5보다 나은가요? Anthropic이 게시한 모든 벤치마크에서 1.4점에서 23.6점까지의 차이로 더 낫습니다. 가장 큰 격차는 Terminal-Bench-Science에서 나타나며, 대부분의 다른 벤치마크에서는 5점 미만의 차이를 보입니다. 이들은 공급업체에서 실행한 결과입니다.
Fable 5.1이 Opus 5 가격의 두 배의 가치가 있나요? 장기 연구 및 터미널 에이전트, 비즈니스 자동화, 그리고 접두사가 많은 에이전트 루프(더 저렴한 캐시 읽기로 인해 턴당 비용이 더 낮아질 수 있는 경우)의 경우, 종종 그렇습니다. 출력량이 많거나, 지연 시간에 민감하거나, 분류 작업의 경우에는 그렇지 않습니다. Anthropic 자체 규칙: 더 높은 노력 수준의 Opus 5가 평가에서 실패할 때만 상위 모델로 전환하십시오.
Fable 5.1과 Opus 5 중 어느 것이 더 빠른가요? Opus 5입니다. Anthropic은 Opus 5를 "보통" 지연 시간으로, Fable 5.1을 "더 느림"으로 분류하며, Opus 5는 최대 2.5배 빠른 출력 속도를 제공하는 고속 모드를 가지고 있습니다. Fable 5.1에는 이러한 기능이 없습니다.
Opus 5가 Fable 5.1과 동일한 안전 분류기를 가지고 있나요? 아닙니다. Opus 5는 사이버 전용 분류기를 실행합니다. Fable 5.1은 생체, 프론티어 LLM, 추론 추출 및 일반 유해성 분류기를 추가합니다. Fable 5.1이 거부할 경우, Opus 5는 허용되는 두 가지 대체 대상 중 하나입니다.
Opus 5처럼 Fable 5.1을 제로 데이터 보존으로 사용할 수 있나요? 아닙니다. Fable 5.1은 30일 보존을 요구하며 Covered Model입니다. Opus 5는 ZDR 하에서 사용 가능합니다.
Opus 5와 Fable 5.1 간에 대화를 전환할 수 있나요? 상위 모델로의 전환은 가능합니다: Fable 5.1은 Opus 5의 사고 블록을 읽습니다. 하위 모델로의 전환 시, API는 Opus 5가 보기 전에 Fable 5.1의 사고 블록을 (과금되지 않고) 삭제하고, Opus 5는 해당 턴을 다시 계획합니다.
