Claude Sonnet 5.5는 Anthropic의 중급 모델로, 2026년 9월 28일에 API ID claude-sonnet-5-5로 출시되었습니다. 입력 토큰 백만 개당 2달러, 출력 토큰 백만 개당 10달러가 청구되며, 이는 Sonnet 5와 동일합니다. Anthropic은 출시 게시물에서 Sonnet 5보다 "30% 이상 더 빠르게 실행"되고, Anthropic의 테스트에서는 "이전 모델보다 작업당 비용이 최대 30% 더 저렴"하다고 밝혔습니다. Claude 5.5 제품군의 두 번째 모델로, Opus 5.5(4달러/20달러)를 보완하는 더 저렴한 모델이자 Haiku 4.5보다 한 단계 높은 모델입니다.
아래는 사양, 라인업, Sonnet 5와의 변경 사항, 벤치마크, 실행 방법, 전환 대상에 대한 내용이며, 요금 분석과 같은 심층 가이드 링크도 포함되어 있습니다. 이 글을 읽으면서 모델을 호출하려면, Apidog를 사용하여 메시지 요청을 보내고, API 키를 환경 변수에 저장하며, 응답과 토큰 사용량을 함께 확인할 수 있습니다.
Claude Sonnet 5.5 사양 한눈에 보기
| 사양 | Claude Sonnet 5.5 |
|---|---|
| 출시일 | 2026년 9월 28일 |
| 모델 ID (Claude API, Google Cloud, Microsoft Foundry, AWS의 Claude Platform) | claude-sonnet-5-5 |
| 모델 ID (Amazon Bedrock) | anthropic.claude-sonnet-5-5 |
| 컨텍스트 창 | 100만 토큰 |
| 최대 출력 | 128K; Batch API에서는 output-300k-2026-03-24 베타를 통해 300K |
| 사고 | 적응형, 기본적으로 활성화 |
| 기본 노력 수준 | Claude Platform에서는 high; Claude Code 및 Claude 앱에서는 medium |
| 지식 마감일 | 2026년 6월 |
| 지원 종료 | 2027년 9월 28일 이전 아님 |
| MTok당 가격 | 입력 2달러, 출력 10달러, 캐시 읽기 0.20달러, 캐시 쓰기 2.50달러(5분) 또는 4달러(1시간); Batch는 1달러/5달러 |
출처: Sonnet 5.5 모델 개요 및 Claude 요금 페이지.
장문 컨텍스트 프리미엄은 없습니다. 90만 토큰 요청은 9천 토큰 요청과 토큰당 비용이 동일합니다. 빠른 모드는 사용할 수 없으며, Opus 전용입니다. 미국 내 추론(inference_geo: "us")은 1.1배의 비용이 발생합니다. Sonnet 5의 9월 1일 3달러/15달러 인상 계획은 취소되었으므로, 2달러/10달러가 표준 Sonnet 요금입니다.
Claude 라인업에서 Sonnet 5.5의 위치
| 모델 | MTok당 입력/출력 | 컨텍스트/최대 출력 | Claude Free에서 사용 가능? | 역할 |
|---|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | 100만 / 128K | 아니요 | 까다로운 추론, 장기적인 에이전트 작업 |
| Claude Opus 5.5 | $4 / $20 | 100만 / 128K | 아니요 | 복잡하고 개방적인 작업 |
| Claude Sonnet 5.5 | $2 / $10 | 100만 / 128K | 예 (채팅) | 명확하게 정의된 일상 작업 |
| Claude Haiku 4.5 | $1 / $5 | 20만 / 64K | 예 | 최저 비용 등급 |
Anthropic은 Sonnet 5.5를 명확하게 정의된 일상 작업, 버그 수정, 잘 다듬어진 문서, 슬라이드 및 스프레드시트에 적합하다고 소개하며, Opus 5.5는 "복잡하고 개방적인 작업에서 분명히 더 강력하다"고 말합니다. Haiku 5.5는 "향후 몇 주 내"에 출시될 예정입니다. 상위 등급에 대해서는 Claude Opus 5.5란 무엇인가를 읽어보세요.
Sonnet 5와 비교하여 새로운 점
가격과 토크나이저는 변경되지 않았습니다. API 계약은 다릅니다. 마이그레이션 가이드에는 다섯 가지 주요 변경 사항이 나와 있습니다.
thinking: {"type": "disabled"}가 사라졌습니다. `{"type": "between_tools"}`를 사용하며,low,medium,high노력 수준에서만 허용됩니다.- 강제 도구 사용이 제거되었습니다. `any` 또는 `tool`로 설정된
tool_choice는 실패합니다. `strict: true` 도구와 함께auto를 보내고, 프롬프트에서 도구 사용 시점을 명시하세요. - 사고 블록이 대화에 바인딩됩니다. 2026년 8월 31일 이후 생성된 계정의 경우, 이전 기록을 편집한 후 블록을 다시 재생하면 실패합니다. 대화는 추가 전용으로 유지하세요.
- Claude API 및 Google Cloud에서 **
computer_20251124가 거부됩니다.** `computer_toolset_20260801`을 사용하세요. - **어드바이저 페어링은** Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 또는 Mythos 5.1으로 **제한됩니다.**

여섯 번째 변경 사항은 실패를 유발하지는 않지만 응답 형태를 변경합니다. 이제 도구 호출 사이에 있는 텍스트는 진행 상황 업데이트 thinking 블록으로 도착하며, 기본 display: "omitted" 설정에서는 비어 있습니다. 따라서 UI가 작업 중에 조용해질 수 있습니다. 이를 보려면 display: "updates" (베타 헤더 thinking-display-updates-2026-08-18) 또는 "summarized"를 설정하세요.
또한 새로운 점:
- 재조정된 노력 수준. Sonnet 5 설정을 복사하지 마세요.
high(또는 명확히 지정된 에이전트 코딩의 경우medium)에서 시작하여 새로 전체를 확인하세요. - 사이버 보호 기능. 이 기능이 탑재된 첫 번째 Sonnet 모델입니다. 위험도가 높은 사이버 작업은 Anthropic 앱에서 "Sonnet 5로 가시적으로 대체"됩니다. API에서는 대체가 옵트인(opt-in) 방식입니다(`fallbacks: "default"`, 베타).
- 계정에 바인딩된 사고. 사고 기능은 계정 간에 이동할 수 없으며, 이는 Claude Code에서 세션 중에 계정을 전환할 때 중요합니다.
- 메시지당 노력 수준. 요청 사이에 최상위 노력 수준을 변경하면 프롬프트 캐시가 무효화됩니다. 베타 메시지당 노력 수준 변경은 이를 방지합니다.
- 낮아진 캐시 최소값. 캐시 가능한 최소 프롬프트는 1,024토큰에서 512토큰으로 줄었습니다.
Sonnet 5.5 vs Sonnet 5 가이드에는 각 수정 사항에 대한 정확한 오류 및 이전/이후 JSON이 포함되어 있습니다.
Claude Sonnet 5.5 벤치마크
출시 표는 Sonnet 5.5를 Sonnet 5, Opus 5.5 및 GPT-6 Sol과 비교합니다. 별도로 명시되지 않는 한 Sonnet 5.5는 최대 노력 수준으로 실행되었습니다.
| 벤치마크 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% (xhigh) | n/r |
| FrontierCode 1.1 Main (max) | 46.2% | 42.4% | 54.4% | 49.3% |
| FrontierCode 1.1 Main (xhigh) | 52.1% | 42.7% | 51.4% | 48.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | n/r |
| GDPval-AA v2.1 (Elo) | 1844 | 1449 | 1846 | 1487 |
| Humanity’s Last Exam (tools) | 64.5% | 54.9% | 67.7% | n/r |
| OSWorld 2.1 (partial) | 80.1% | 57.0% | 81.8% | n/r |
n/r: 보고되지 않음. xhigh FrontierCode 행은 출시 페이지의 노력 수준별 차트에서 가져온 것입니다.
Anthropic은 Terminal-Bench, Humanity’s Last Exam 및 OSWorld를 직접 실행했습니다. Cognition은 FrontierCode를 실행했는데, Sonnet 5.5는 최대 노력 수준에서 더 낮은 점수를 기록했습니다. 이는 Sonnet 5.5가 검토 서브 에이전트를 더 자주 분산시켰기 때문이며, Cognition이 조사한 사례에서는 시간 초과 또는 범위를 벗어난 편집을 야기했습니다. Cursor는 CursorBench를 실행했고, Artificial Analysis는 GDPval-AA를 실행했습니다. Opus에 대한 Terminal-Bench의 우위를 주의 깊게 읽으세요. Artificial Analysis는 자체 실행에서 Sonnet 5.5를 63.6%로 측정했으며, 시스템 카드에는 Opus 테스트의 10%가 대체(fallback)되었고 Sonnet 테스트의 1.5%가 대체되었다고 명시되어 있습니다.
Sonnet 5.5는 Artificial Analysis Intelligence Index에서 216개 모델 중 3위인 56점을 기록했으며, 두 개의 Opus 5.5 엔드포인트 뒤를 잇습니다 (Sonnet 5는 38점). 문제는 장황함입니다. 최대 노력 수준에서 인덱스를 실행하는 데 8,977달러가 들었지만, 높은 노력 수준에서는 1,176달러였습니다. 벤치마크 심층 분석에는 노력 수준별 표가 있습니다.
Claude Sonnet 5.5를 사용할 수 있는 곳
| 플랫폼 | 접근 | 참고 |
|---|---|---|
| Claude API | claude-sonnet-5-5 |
선불 크레딧 |
| Amazon Bedrock | anthropic.claude-sonnet-5-5 |
글로벌 교차 리전 추론 전용 (상업적 리전); 엄격한 도구 없음 |
| Google Cloud, Microsoft Foundry, AWS의 Claude Platform | claude-sonnet-5-5 |
Claude API와 동일한 ID |
| Claude.ai (웹, iOS, Android) | 채팅 | 무료 사용자 포함 누구나 |
| Claude Code | claude --model claude-sonnet-5-5 |
유료 플랜, v2.1.284 이상; 기본 모델은 Opus 5.5 유지 |
| GitHub Copilot | VS Code, JetBrains, Copilot CLI 등 | Pro, Pro+, Max, Business, Enterprise |
| Cursor | claude-sonnet-5-5 |
기타 모델 풀 (Pro 이상) |
| OpenRouter, Vercel AI Gateway | anthropic/claude-sonnet-5.5 |
2달러 / 10달러; 무료 변형 없음 |
Claude Code에서 sonnet 별칭은 Anthropic API에서만 Sonnet 5.5로 매핑됩니다. Bedrock, Google Cloud 및 Foundry에서는 여전히 Sonnet 4.5로 해결되므로 전체 ID를 고정해야 합니다. 플랜 및 노력 수준에 대한 내용은 Claude Code의 Sonnet 5.5를 참조하세요. GitHub의 Copilot 변경 로그에 따르면 출시가 점진적으로 이루어지고 있습니다.
누구나 Claude Free 플랜에서 Sonnet 5.5와 채팅할 수 있지만, 채팅 플랜에는 API 키가 포함되어 있지 않으며 API 사용은 선불입니다. Sonnet 5.5를 무료로 사용하는 방법과 무료 Sonnet 5.5 API의 존재 여부를 확인하세요.
Sonnet 5.5로 전환해야 하는 사람
- Sonnet 5를 사용 중인 경우: 전환하세요. 가격과 토크나이저가 일치하며, Sonnet 5.5는 출시 표의 모든 항목에서 Sonnet 5를 능가합니다. 주요 변경 사항과 노력 수준 테스트를 위한 시간을 할애하세요.
- 모든 작업에 Opus 5.5를 사용 중인 경우: 명확하게 정의된 작업(버그 수정, 문서, 간단한 코드 검토, 서브 에이전트 작업)은 절반 가격으로 Sonnet 5.5로 전환하고, 개방형 문제에는 Opus를 계속 사용하세요. Sonnet 5.5 vs Opus 5.5 비교는 이를 워크로드별로 분석합니다.
- 높은 노력 수준 이상으로 실행할 계획인 경우: Opus 5.5를 더 낮은 노력 수준에서도 테스트해보세요. Terminal-Bench 4.0에서 Sonnet 5.5는 높은 노력 수준에서 시도당 1.94달러로 43.0%를 기록했습니다. Opus 5.5는 중간 노력 수준에서 시도당 2.94달러로 57.6%를 기록했습니다. Sonnet의 최대 노력 수준 70.6%는 시도당 12.54달러입니다. 많은 Hacker News 댓글 작성자들은 차트를 이렇게 해석합니다. Sonnet의 틈새시장은 낮은 또는 중간 노력 수준 작업, 또는 Opus 오케스트레이터 아래의 서브 에이전트 작업입니다.
- 보안 관련 작업이 많은 경우: Anthropic은 "양성적인 사이버 보안 관련 작업에서도" 거부율이 증가할 수 있다고 경고합니다.
초기 고객 보고서
독립적인 테스트가 아닌 Anthropic 출시 페이지의 고객 주장:
- Slack: 프롬프트 변경 없이 거의 모든 오프라인 Slackbot 평가에서 Sonnet 5를 능가했으며, 약 14% 적은 출력 토큰을 사용했습니다.
- Base44: 118개 앱 빌드에서 빌드당 3.6회 반복으로 Opus 5와 동일한 품질을 달성했으며, Opus 5는 7.7회였습니다.
- Balyasny Asset Management: 2,441개 금융 작업에서 답변당 약 121K 토큰을 사용했으며, Sonnet 5는 497K 토큰을 사용했습니다.
첫 Sonnet 5.5 요청 보내기
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 16000,
"output_config": {"effort": "medium"},
"messages": [
{"role": "user", "content": "List three risks of retrying a POST request without an idempotency key."}
]
}'
사고 기능은 기본적으로 활성화되어 있으므로 thinking 필드를 건너뛰세요. temperature, top_p, top_k는 생략하세요. 기본값이 아닌 값을 사용하면 400 오류가 반환됩니다. 거부(Refusal)는 stop_reason: "refusal" 및 stop_details 카테고리와 함께 HTTP 200으로 반환되므로, 상태뿐만 아니라 본문도 확인하세요.
Apidog에서 curl 명령을 새 요청에 붙여넣고, 키를 ANTHROPIC_API_KEY 환경 변수로 이동한 다음, stop_reason이 refusal 또는 max_tokens가 아닌지 확인하세요. low 및 high 노력 수준으로 복제하여 usage를 비교해보세요. Sonnet 5.5 API 가이드는 스트리밍, 도구 및 캐싱을 다룹니다. 키가 필요한 경우 Anthropic API 키 가이드가 도움이 될 것입니다.
자주 묻는 질문
Claude Sonnet 5.5는 언제 출시되었나요? 2026년 9월 28일, Opus 5.5 출시 6일 후입니다.
Claude Sonnet 5.5의 컨텍스트 창은 얼마인가요? 100만 토큰이며, 최대 출력은 128K입니다 (베타 헤더를 사용하면 Batch API에서 300K). 긴 프롬프트는 짧은 프롬프트와 토큰당 비용이 동일합니다.
Claude Sonnet 5.5는 무료인가요? Claude.ai 채팅 앱에서는 무료 플랜을 포함하여 무료입니다. API는 선불이며 Claude Code는 유료 플랜이 필요합니다. 모든 무료 사용 방법을 참조하세요.
Claude Sonnet 5.5의 지식 마감일은 언제인가요? 2026년 6월입니다.
Sonnet 5.5가 Claude Code의 기본 모델인가요? 아니요. 모든 유료 플랜에서 기본 모델은 Opus 5.5입니다. /model 또는 claude --model claude-sonnet-5-5를 사용하여 전환하세요.
다음 단계
현재 Sonnet 5 또는 Opus 5.5에서 실행하는 작업 중 하나를 선택하세요. 이를 claude-sonnet-5-5에 low, medium, high 노력 수준으로 전송하고, 품질과 usage를 비교한 후, 검사를 통과하는 가장 저렴한 설정을 유지하세요. Apidog를 다운로드하여 해당 요청과 어설션을 하나의 프로젝트에 보관한 다음, 요금 분석을 사용하여 토큰 수를 월별 청구서로 변환하세요.

