Anthropic은 2026년 7월 24일 Claude Opus 5를 출시했고, 한 시간 이내에 모든 팀이 던진 질문은 똑같았습니다. 만약 Opus 5가 절반 가격에 Fable 5에 근접한다면, 누가 Fable 5에 계속 돈을 지불할까요?
숫자는 간단합니다. Opus 5는 백만 입력 토큰당 5달러, 백만 출력 토큰당 25달러입니다. Fable 5는 10달러와 50달러로, 계층이나 최소 사용량에 대한 작은 글씨 없이 양쪽에서 정확히 2배의 차이가 납니다. Anthropic 자체 출시 발표에 따르면 Opus 5는 CursorBench 3.2에서 Fable 5 최고 성능의 0.5% 이내에 들고, OSWorld 2.0에서는 3분의 1 비용으로 Fable 5를 능가합니다.
직접 비교를 실행하고 싶다면, Apidog에서 두 모델 ID에 동일한 프롬프트를 보내고 응답과 토큰 수를 나란히 비교할 수 있습니다.
버튼
두 모델 한눈에 보기
| Claude Opus 5 | Claude Fable 5 | |
|---|---|---|
| API 모델 ID | claude-opus-5 |
claude-fable-5 |
| 입력 가격 | $5 / MTok | $10 / MTok |
| 출력 가격 | $25 / MTok | $50 / MTok |
| 컨텍스트 창 | 1M 토큰 (기본 및 최대) | 1M 토큰 |
| 최대 출력 | 128k (베타 헤더를 사용한 Batch에서는 300k) | 128k |
| 지식 업데이트 시점 | 2026년 5월 | 2026년 1월 |
| 포지셔닝 | Anthropic의 권장 기본 모델 | 가장 강력한 광범위 출시 모델 |
| 추론 | 적응형, 기본적으로 켜져 있으며, 노력(effort)으로 제어 가능 | 항상 켜짐 |
| 출시일 | 2026년 7월 24일 | 2026년 6월 초 |
다른 무엇보다 두 줄을 다시 살펴볼 가치가 있습니다.
지식 업데이트 시점(cutoff) 행은 일반적인 "새로운 계층은 더 저렴하고, 이전 계층은 더 똑똑하다"는 통념에 반대됩니다. Opus 5는 2026년 5월까지의 세계를 알고 있습니다. Fable 5는 Sonnet 5와 동일하게 2026년 1월에서 멈춥니다. 4개월간의 패키지 릴리스, 프레임워크 버전, API 변경 사항이 Opus 5의 훈련 데이터에는 포함되어 있지만 Fable 5에는 포함되어 있지 않습니다. 빠르게 변화하는 라이브러리를 다루는 작업이라면, 더 저렴한 모델이 더 최신입니다.

포지셔닝 행은 다른 방향을 가리킵니다. Anthropic은 여전히 Fable 5를 가장 강력한 광범위 출시 모델로 설명하며, 이 라벨을 Opus 5로 옮기지 않았습니다. Opus 5는 권장 기본 모델인데, 이는 다른 주장입니다. 즉, 확신이 없을 때 선택해야 하는 모델이지, 어떤 모델이든 할 수 있는 작업의 한계에 있는 과제에 선택해야 하는 모델은 아니라는 뜻입니다.
새 모델의 전체 사양 시트는 저희의 Claude Opus 5 설명서를 참조하십시오. Fable 5의 출시 세부 정보는 Claude Fable 5란 무엇인가를 참조하십시오.
Anthropic의 실제 주장
다음은 Anthropic이 발표한 대로 이 비교와 관련된 출시 주장입니다.
| 벤치마크 | Opus 5에 대한 Anthropic의 주장 |
|---|---|
| CursorBench 3.2 | 절반 가격으로 Fable 5 최고 성능의 0.5% 이내 |
| OSWorld 2.0 (컴퓨터 사용) | 3분의 1 비용으로 Fable 5 능가 |
| Frontier-Bench v0.1 | 다른 모든 모델 능가; Opus 4.8 점수의 두 배 이상 |
| ARC-AGI 3 | 차점 모델의 약 3배 |
| Zapier AutomationBench | 합격률이 차점 모델의 약 1.5배 |
| 유기 화학 | Opus 4.8 대비 +10.2점 |
| 단백질 분석 | Opus 4.8 대비 +7.7점 |
이제 주의사항입니다. 이것이 핵심이기 때문입니다. 이 모든 수치는 공급업체 자체 테스트 결과입니다. Anthropic은 평가 설정을 설계하고, 노력(effort) 설정을 선택하고, 결과를 발표했습니다. 2026년 7월 25일 현재, 독립적으로 재현된 것은 없습니다. 이는 불성실함을 비난하는 것이 아니라, 출시 이틀째의 정상적인 상태입니다. 그러나 "Fable 5의 0.5% 이내"는 특정 구성의 특정 하네스를 설명하며, 사용자 작업에서 측정하는 격차는 더 크거나 작을 수 있습니다.
OSWorld 주장은 두 가지 직접 비교 수치 중 더 흥미로운데, 이는 Opus 5가 Fable 5에 근접하는 것이 아니라 능가한다고 말하는 부분이기 때문입니다. 컴퓨터 사용 작업은 순수한 추론 깊이보다 끈기와 회복력을 보상하며, 이는 에이전트 루프에 최적화된 모델에 적합합니다. CursorBench 주장은 좀 더 완화된 것입니다. "Fable 5 최고 성능의 0.5% 이내"라는 것은 Fable 5가 여전히 최고를 유지한다는 것을 의미합니다.
각 벤치마크가 무엇을 측정하고 측정하지 않는지를 포함하여 모든 수치를 Opus 5 벤치마크 심층 분석에서 자세히 설명합니다. Fable 5 자체 출시 수치는 Fable 5 벤치마크 게시물에 있습니다.
Opus 5의 강점
가격 격차는 일정하며 복합적으로 작용합니다. Fable 5에서 월 3,000달러가 드는 작업량이 Opus 5에서는 5달러/25달러 대 10달러/50달러로 동일한 토큰 볼륨에 대해 1,500달러가 듭니다. 어떤 임계치나 약정도 이 격차를 줄이지 못합니다.
비용 절감 효과는 반값 할인 위에 더해집니다. Opus 5의 Batch API 요금은 2.50달러/12.50달러로, 추가 50% 할인됩니다. 캐시 적중 및 새로고침은 백만 건당 0.50달러이며, 프롬프트 캐싱 최소값이 512토큰(Opus 4.8에서는 1,024토큰)으로 줄어들어, 이전에 캐시하기에는 너무 작았던 짧은 시스템 프롬프트도 이제 코드 변경 없이 캐시됩니다. 도구 사용 시스템 프롬프트 오버헤드도 낮아졌습니다. tool_choice를 auto 또는 none으로 설정하면 286토큰으로, Opus 4.8의 290토큰과 Opus 4.7의 675토큰에 비해 줄었습니다. 이러한 모든 요소가 실제 청구서에 영향을 미칩니다. Opus 5 가격 분석에 전체 표가 있으며, Claude API 요금 절감에는 일반적인 절감 방법이 설명되어 있습니다.
작업에 필요할 때 더 많은 비용을 지출할 수 있습니다. Opus 5의 output_config.effort 매개변수는 기본값이 high이며, 출시와 함께 레벨이 재조정되어 low 및 medium이 이전 Opus 모델보다 의미 있게 강력해졌습니다. 이는 고정된 요금 대신 조절할 수 있는 다이얼을 제공합니다. low에서는 저렴한 분류, xhigh에서는 어려운 에이전트 코딩이 가능합니다. 노력(effort) 매개변수 가이드는 이전 설정을 그대로 가져가는 대신 실행해야 할 전체 범위를 설명합니다.
4개월 더 최신 모델입니다.
기본값으로 자리 잡고 있습니다. Opus 5는 Max 구독자를 위한 새로운 기본 모델이자 Pro 사용자가 사용할 수 있는 최고 성능의 모델이며, Claude API, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, AWS의 Claude Platform, Google Cloud, Microsoft Foundry, GitHub Copilot에 제공됩니다. Anthropic의 모델 개요에는 어떤 모델을 사용해야 할지 확실하지 않다면 Opus 5로 시작하라고 명확히 명시되어 있습니다.
Fable 5의 강점
비싼 모델의 강점을 옹호하는 것은 더 어려운 일이므로, 예의를 갖추기보다 구체적으로 설명하겠습니다.
능력 등급은 변경되지 않았습니다. Anthropic은 출시 당일에 Opus 5를 가장 강력한 광범위 출시 모델로 선정할 수도 있었습니다. 그러나 그렇게 하지 않았습니다. 공급업체가 더 저렴하고 자랑스러운 모델을 출시하면서도 더 오래되고 비싼 모델에 최고라는 수식어를 유지한다면, 이는 마케팅 실수가 아니라 능력 곡선의 정점에 대한 신호입니다. 단 한 번의 실패한 실행이 한 달 API 비용보다 더 비싼 가장 어려운 문제에서, Anthropic이 여전히 가리키는 모델은 Fable 5입니다. 이러한 포지셔닝에 대한 참고 자료는 출시 발표입니다.
항상 켜져 있는 추론은 실패 모드를 제거합니다. Fable 5는 모든 요청에 대해 추론합니다. Anthropic의 모델 비교는 적응형 추론을 "항상 켜짐"으로 나열하며, 현재 유일하게 그렇게 설명된 모델입니다. Opus 5는 추론을 비활성화할 수 있으며, Anthropic 자체 프롬프팅 가이드라인은 그렇게 했을 때 발생하는 상황을 문서화합니다. 즉, 도구 호출이 실행되는 대신 일반 텍스트로 가끔 작성되고(그리고 유출된 텍스트는 에이전트 루프의 후속 턴을 오염시킴), 내부 XML 태그가 때때로 보이는 출력에 나타납니다. Anthropic이 권장하는 완화책은 추론을 계속 켜두고 대신 더 낮은 노력(effort)으로 비용을 제어하는 것입니다. 사용자에게 발등을 찍을 기회를 주지 않는 모델은 그것으로 인해 피해를 입을 수 없습니다.
Opus 5의 유연성에는 날카로운 단점이 있습니다. thinking: {type: "disabled"}와 xhigh 또는 max 노력(effort)을 결합하면 요청당 400 오류가 반환됩니다. 이제 thinking 필드를 생략하면 추론이 기본적으로 실행되므로, 추론하지 않는 작업량을 위해 설정된 max_tokens 예산이 잘릴 수 있습니다. Opus 5는 또한 하위 에이전트에 더 쉽게 위임하고 더 긴 기본 응답을 생성하는데, 이 둘 모두 제한하지 않으면 조용히 비용을 증가시킵니다. Fable 5는 이러한 마이그레이션 표면을 전혀 가지고 있지 않습니다. 마이그레이션하는 경우, Opus 4.8에서 Opus 5로의 마이그레이션 가이드에 모든 주요 변경 사항이 자세히 설명되어 있습니다.
전환 비용은 0이 아닙니다. 여러분의 평가, 프롬프트, 노력(effort) 설정 및 비용 모델은 현재 사용 중인 모델에 맞춰 조정되어 있습니다. "절반 가격"은 토큰당 비용을 의미하며, 프로젝트 총비용을 의미하는 것은 아닙니다. 마이그레이션에 두 명의 엔지니어가 일주일이 걸리고 작업량이 적다면, 산술적으로 이득이 되지 않습니다. Fable 5와 Opus 4.8 비교는 Fable 티어가 Opus 티어에 비해 일반적으로 제공하는 이점을 다루고, Fable 5 가격은 그 비용 구조를 다룹니다.
실제 요청에서 가격 격차는 어떻게 나타나는가
승수(multipliers)는 쉽게 고개를 끄덕일 수 있지만 체감하기는 어렵습니다. 다음은 한 가지 에이전트 코딩 작업입니다. 200,000개의 입력 토큰(대규모 저장소 컨텍스트와 긴 도구 호출 이력)과 20,000개의 출력 토큰.
| Opus 5 | Fable 5 | |
|---|---|---|
| 입력 (20만) | $1.00 | $2.00 |
| 출력 (2만) | $0.50 | $1.00 |
| 작업당 | $1.50 | $3.00 |
| 월 500개 작업 | $750 | $1,500 |
| 월 5,000개 작업 | $7,500 | $15,000 |
월 500개 작업 시 격차는 750달러입니다. 이는 대부분의 엔지니어링 예산에서 미미한 수준이며, Fable 5가 한 달에 한 번의 실패한 실행을 막아준다면 그 자체로 비용을 상쇄합니다. 월 5,000개 작업 시 격차는 연간 90,000달러이며, 이는 인력 배치에 대한 논의로 이어집니다.
따라서 결정 규칙은 어떤 모델이 더 똑똑한지가 아니라 볼륨에 관한 것입니다. 월 몇백 개의 어려운 작업 미만에서는 기능에 따라 선택하고 가격은 무시하세요. 수천 개 이상에서는 Anthropic의 테스트 환경에서가 아니라 사용자 작업에서 Fable 5가 더 낫다는 증거가 필요합니다.
한 가지 더 산술적인 사실: Opus 5의 고속 모드(2.5배 출력 속도, 자체 API에서만 연구 프리뷰로 제공)는 10달러/50달러로, Fable 5의 기본 요금과 정확히 동일합니다. 기능보다 지연 시간이 제약 조건이라면, 더 느린 Fable 5 대신 더 빠른 Opus 5에 Fable 5 비용을 지출할 수 있습니다. inference_geo: "us"가 Opus 5의 모든 토큰 범주에 1.1배의 승수를 추가하여 이 수치를 10% 변경한다는 점에 유의하십시오.
작업량별 의사결정 프레임워크
| 작업량 | 선택 | 이유 |
|---|---|---|
| 에이전트 코딩, 고볼륨 | Opus 5 | Anthropic은 CursorBench에서 절반 비용으로 0.5% 이내의 성능을 보고; 볼륨이 격차를 실제 비용으로 만듦 |
| 컴퓨터 사용 및 브라우저 자동화 | Opus 5 | Anthropic이 Opus 5가 Fable 5를 완전히 능가한다고 주장하는 유일한 벤치마크 |
| 2026년 1월 이후 라이브러리를 사용하는 작업 | Opus 5 | 2026년 5월 지식 업데이트 시점 대 2026년 1월 |
| 비용에 민감한 프로덕션 트래픽 | Opus 5 | 반값, 배치 처리, 512토큰 캐시 최소값, 그리고 low/medium 노력(effort) |
| 단일 고위험 추론 실행 | Fable 5 | 여전히 Anthropic의 가장 강력한 광범위 출시 모델; 낮은 볼륨에서는 실행당 비용이 무관함 |
| 중간 실행 실패가 비싼 장기 자율 세션 | Fable 5 | 항상 켜져 있는 추론, 비활성화된 추론 아티팩트 없음, 새로운 마이그레이션 표면 없음 |
| Fable 5에서 이미 안정적, 낮은 볼륨 | Fable 5 | 마이그레이션 비용이 절감액을 초과함 |
| 사이버 보안 익스플로잇 또는 자율 생물학 연구 | 둘 다 아님, 아래 참조 | 둘 다 Mythos 5에 뒤쳐짐 |
패턴: Opus 5는 처리량 경제성에서 승리하고, Fable 5는 꼬리 위험에서 승리합니다. 많은 작업을 실행하고 가끔 더 약한 결과를 허용할 수 있다면, 비용을 절반으로 줄이는 것이 명백한 선택입니다. 적은 작업을 실행하고 단 한 번의 나쁜 결과가 비싸다면, 가격 차이는 최적화해야 할 대상이 아닙니다.
사용자 작업에서 비교 실행하기
공급업체 벤치마크는 다른 사람의 작업에서 무슨 일이 일어났는지 알려줍니다. 이 결정을 내리는 데 필요한 숫자는 사용자 자신의 평가 세트에서 나오며, 이를 얻는 데는 오후 한나절이 걸립니다. 두 모델 모두 동일한 Messages 엔드포인트 뒤에 있으므로, 비교는 한 문자열 변경으로 이루어집니다.
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"output_config": {"effort": "high"},
"messages": [
{"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
]
}'
claude-opus-5를 claude-fable-5로 바꾸면 테스트의 다른 쪽을 얻을 수 있습니다. Apidog에서의 실제 설정은 다음과 같습니다.
- API 키를 환경 변수로 저장하여 요청 본문에 노출되지 않도록 하고, 모델 ID를 변수로 사용하여 모델별로 하나의 환경을 생성합니다.
- 요청을 컬렉션에 저장하고 두 환경에 대해 동일한 시나리오를 실행하여 변경되는 유일한 것이 모델 문자열이 되도록 합니다.
- 각 응답에서
usage필드를 읽으십시오. 입력, 출력 및 캐시 읽기 토큰을 비교하십시오. Opus 5는 기본적으로 더 긴 응답을 생성하는 경향이 있으므로, 여기서 실제 비용 차이가 나타납니다. - 에이전트 행동을 비교할 때 SSE 스트림과 도구 호출 페이로드를 검사하십시오. 모델이 도구를 실행했는지 아니면 호출을 텍스트로 작성했는지는 원시 이벤트 스트림에서 확인할 수 있습니다.
- Opus 5를
low,medium,high,xhigh노력(effort) 수준으로 반복 실행하십시오. 실제 질문은 보통 "Opus 5인가 Fable 5인가"가 아니라 "Opus 5의 어떤 노력 수준이 내가 지불하는 Fable 5 출력과 일치하는가"입니다.
5단계는 대부분의 팀이 건너뛰지만, 돈을 결정하는 단계입니다. 환경 설정을 위해 Apidog를 다운로드하거나, Opus 5 API 가이드에서 전체 요청 안내를 따르십시오. Anthropic의 가격 페이지에는 두 모델에 대한 공식 요금이 나와 있습니다.
버튼
솔직한 상한선
이 비교 대상 모델 중 어느 것도 Anthropic 스택의 최고는 아닙니다.
Anthropic 자체 지정에 따르면 Fable 5는 여전히 가장 강력한 광범위 출시 모델이며, Opus 5는 그 타이틀을 가져가지 못했습니다. 그리고 이 두 모델 위에, 두 가지 특정 능력 축에서 Mythos 5가 있습니다. Anthropic은 Opus 5가 사이버 보안 익스플로잇과 자율 생물학 연구에서 여전히 Mythos 5에 뒤처진다고 말합니다. Mythos 5는 일반 대중이 아닌 제한된 프로그램과 함께 Fable 5에 출시된 분류기 없는 자매 모델이므로, 대부분의 팀에게는 선택 사항이 아닙니다. Fable 5 대 Mythos 5 비교에서 자격 요건을 다룹니다.
따라서 Opus 5에 대한 정확한 요약은 헤드라인보다 좁습니다. 최고 수준 능력의 절반 가격으로, 그 위에 명확한 상한선이 있는 모델. 이것은 강력한 제품입니다. 이는 "최고의 모델이 이제 절반 가격"이라는 말이 아니며, 그렇게 말하는 사람은 Anthropic 자체가 더 비싼 모델에 능력의 왕관을 유지했다는 부분을 건너뛰는 것입니다.
FAQ (자주 묻는 질문)
Claude Opus 5가 Fable 5보다 나은가요? Anthropic 자체 벤치마크에서 Opus 5는 OSWorld 2.0 컴퓨터 사용 작업에서 Fable 5를 능가하며, CursorBench 3.2에서는 Fable 5 최고 성능의 0.5% 이내에 들면서도 비용은 훨씬 저렴합니다. 이러한 수치는 2026년 7월 25일 현재 공급업체 자체 테스트 결과이며 독립적으로 재현되지 않았습니다. Anthropic은 여전히 Fable 5를 가장 강력한 광범위 출시 모델로 지정하고 있으므로, 가장 어려운 작업에서는 Fable 5가 우위를 유지합니다.
Opus 5가 Fable 5보다 얼마나 저렴한가요? 양쪽 모두 정확히 절반입니다. 백만 입력/출력 토큰당 5달러/25달러 대 10달러/50달러입니다. Opus 5의 Batch API 요금인 2.50달러/12.50달러는 긴급하지 않은 작업의 경우 격차를 더욱 벌립니다.
어떤 모델이 더 최신 지식 업데이트 시점을 가지고 있나요? Opus 5가 4개월 더 최신입니다. Opus 5의 신뢰할 수 있는 지식 업데이트 시점은 2026년 5월입니다. Fable 5는 2026년 1월입니다.
Fable 5 작업량을 Opus 5로 마이그레이션해야 할까요? 먼저 볼륨에 대한 수치를 확인하십시오. 월 수백 개 미만의 어려운 작업에서는 절감액이 마이그레이션 작업을 정당화하기 어렵습니다. 수천 개 이상에서는 사용자 자신의 평가 세트가 품질 유지를 확인해 준다면 분명히 마이그레이션이 이득입니다.
각 모델의 모델 ID는 무엇인가요? claude-opus-5 및 claude-fable-5이며, 둘 다 날짜 접미사가 없습니다. Amazon Bedrock에서는 Opus 5가 anthropic.claude-opus-5입니다.
Opus 5가 지원하지만 Fable 5는 지원하지 않는 기능이 있나요? Opus 5는 재조정된 수준의 output_config.effort 매개변수를 노출하고, 대화 중간 시스템 메시지를 허용하며, 10달러/50달러에 고속 모드를 지원하고, 512토큰만큼 짧은 프롬프트도 캐시합니다. 반대 방향의 한 가지 차이점: Opus 4.8은 Priority Tier를 유지하지만, Opus 5에서는 지원되지 않습니다.
간단한 답변
대부분의 팀에게 절반 가격은 가치가 있으며, 그 이유는 기능보다는 볼륨 때문입니다. Anthropic의 수치에 따르면 Opus 5는 에이전트 코딩에서 충분히 근접하고 컴퓨터 사용에서는 앞서 있어, 월 수천 개의 작업에서 2배의 절감 효과가 실제 예산으로 전환됩니다. 더 최신인 2026년 5월 지식 업데이트 시점과 노력(effort) 다이얼을 더하면 기본 답변은 Opus 5입니다.
Fable 5는 어떤 모델이든 할 수 있는 작업의 한계에 있거나, 단 한 번의 실패한 실행이 가격 차이보다 더 많은 비용을 초래하거나, 마이그레이션 작업이 절감액보다 더 큰 낮은 볼륨의 경우에 유지하십시오. 그리고 여기에 있는 모든 벤치마크는 있는 그대로 받아들이십시오. 즉, 공급업체 자체 테스트 환경에서 공급업체 자체 측정이며, 누군가 재현하기를 기다리고 있다는 것입니다. 사용자 자신의 평가 세트가 최종 결정권입니다.
버튼
