클로드 하이쿠 5.5(`claude-haiku-5-5`, 2026년 10월 7일 출시)는 최대 10만 토큰 프롬프트의 경우 하이쿠 4.5보다 90% 저렴합니다(입력/출력 토큰 백만 개당 $0.10/$0.50 대 $1/$5). 컨텍스트 창은 20만 토큰 대신 100만 토큰이며, 두 모델이 모두 포함된 모든 출시 벤치마크에서 훨씬 더 높은 점수를 기록했습니다. 단점은 4.5에서 작동하던 5가지 요청 형태가 이제 400 오류를 반환하며, 몇 가지 추가 변경 사항은 오류 없이 응답과 비용을 변경한다는 것입니다.
아래에는 하이쿠 4.5와 5.5를 비교하는 표, JSON 이전/이후를 보여주는 각 파괴적 변경 사항, 조용한 변경 사항, 그리고 Apidog용 테스트 계획이 있습니다. 전체 사양표를 보려면 클로드 하이쿠 5.5란 무엇인가를 읽어보세요. 이전 모델을 계속 사용 중이라면 클로드 하이쿠 4.5 API 가이드를 참조하십시오.
버튼
하이쿠 4.5 vs 하이쿠 5.5 한눈에 보기
| 클로드 하이쿠 4.5 | 클로드 하이쿠 5.5 | |
|---|---|---|
| 모델 ID (클로드 API) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| 컨텍스트 / 최대 출력 | 200K / 64K | 1M / 128K |
| MTok당 입력 / 출력 | $1 / $5 | 10만 토큰 이하 프롬프트의 경우 $0.10 / $0.50; 초과 시 $0.50 / $2.50 |
| MTok당 캐시 읽기 / 5분 쓰기 | $0.10 / $1.25 | 10만 토큰 이하의 경우 $0.01 / $0.125; 초과 시 $0.05 / $0.625 |
| MTok당 배치 입력 / 출력 | $0.50 / $2.50 | 10만 토큰 이하의 경우 $0.05 / $0.25; 초과 시 $0.25 / $1.25 |
| 사고 (Thinking) | 수동 budget_tokens |
적응형만 가능, 기본값으로 켜짐 |
| 노력 수준 (Effort levels) | 없음 | low, medium (기본), high, xhigh, max |
| 최소 캐시 가능 프롬프트 | 4,096 토큰 | 512 토큰 |
| 토크나이저 | 구형 | 동일한 텍스트에 대해 약 30% 더 많은 토큰 |
| 비기본 샘플링 파라미터, 프리필 | 허용됨 | 400 오류 |
| 우선순위 티어 (Priority Tier) | 지원됨 | 지원 안됨 |
| 상태 | 활성, 2026년 10월 15일 이전 단종 없음 | 활성, 2027년 10월 7일 이전 단종 없음 |
하이쿠 4.5는 더 이상 사용되지 않는 모델이 아닙니다. 모델 사용 중단 페이지에서는 사용 중단 날짜 없이 활성 상태로 표시되어 있으므로, 사용자 일정에 맞춰 마이그레이션할 수 있습니다. 두 모델의 속도 제한은 동일합니다.
5가지 파괴적 변경 사항
하이쿠 4.5에서 작동하는 본문이 하이쿠 5.5에서는 400 오류를 반환합니다. 하이쿠 5.5 마이그레이션 가이드에 모든 내용이 나와 있습니다.
1. budget_tokens를 사용한 수동 사고(thinking)
하이쿠 5.5는 적응형 사고만 실행합니다. 고정된 예산은 거부됩니다.
// 이전 (하이쿠 4.5)
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
// 이후 (하이쿠 5.5)
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
이제 노력(effort)이 조절의 핵심입니다. 4.5에서 적은 예산을 사용했다면 더 낮은 노력을 선택하십시오. 여전히 thinking: {"type": "disabled"}를 보낼 수 있지만, high 노력 이하에서만 가능합니다. xhigh 또는 max에서는 이 역시 400 오류를 반환합니다.
2. 샘플링 파라미터
temperature, top_p, top_k를 제거하십시오. 허용되는 유일한 값은 temperature: 1과 top_p: 0.99입니다. top_p: 1, 모든 top_k, 그리고 temperature와 top_p를 함께 보내는 경우를 포함하여 다른 모든 값은 400 오류를 반환합니다.
// 이전 (하이쿠 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"temperature": 0.2, "top_k": 40,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
// 이후 (하이쿠 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
일관된 출력을 위해 낮은 temperature를 사용했다면, 그 의도를 프롬프트로 옮기십시오.
3. 어시스턴트 프리필
모델이 계속할 수 있도록 하는 마지막 어시스턴트 턴은 사고(thinking)가 꺼져 있어도 거부됩니다. messages는 사용자 턴으로 끝내십시오.
// 이전 (하이쿠 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
] }
// 이후 (하이쿠 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"system": "Reply with only a JSON object. No preamble.",
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." }
] }
엄격한 형식의 경우, 마이그레이션 가이드에서는 구조화된 출력이나 분류를 위한 열거형 필드가 있는 도구를 사용하도록 안내합니다.
4. 컴퓨터 사용: computer_20250124에서 computer_toolset_20260801로
클로드 API 및 Google Cloud에서 하이쿠 5.5는 새로운 툴셋을 통해서만 컴퓨터 사용을 지원합니다. computer-use-2025-01-24 베타 헤더를 제거하고, fine-grained-tool-streaming-2025-05-14를 전송하는 경우 이 역시 제거하십시오. 툴셋과 함께 사용하면 400 오류가 발생합니다.
// 이전 (하이쿠 4.5, 헤더 anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
"tools": [{ "type": "computer_20250124", "name": "computer",
"display_width_px": 1280, "display_height_px": 800 }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
// 이후 (하이쿠 5.5, 베타 헤더 없음)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"tools": [{ "type": "computer_toolset_20260801" }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
에이전트 루프도 변경됩니다. input.action 대신 각 tool_use 블록의 name과 toolset_name을 사용하여 디스패치하고, 결과에 toolset_name을 반환하십시오. 하이쿠 5.5는 하이쿠 4.5가 지원하지 않는 브라우저 사용 도구(`browser_toolset_20260801`)도 제공합니다. 더 자세한 내용은 클로드 코드 컴퓨터 사용을 참조하십시오.
5. 사고(thinking) 블록 이전의 이전 턴 편집
하이쿠 5.5 사고(thinking) 블록은 그 이전에 전송된 모든 내용이 변경되지 않은 경우에만 유효합니다. system, tools 또는 이전 메시지를 변경하고 블록을 다시 보내면 400 오류가 발생합니다. 하이쿠 4.5는 이 검사를 실행하지 않았습니다. 여기서는 턴 1에서 "system": "You are a billing agent."를 전송했고 턴 2에서 이를 편집합니다.
// 이전: 시스템 편집 + 사고 블록 재실행 = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent. Be brief.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412." }
] }
// 이후: 이전 턴 변경 없음, 새 지시 추가
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412. Be brief." }
] }
2026년 8월 31일 00:00 UTC 이전에 생성된 계정의 경우, thinking.block_binding.prefix_mismatch_behavior를 설정한 요청에서만 오류가 나타납니다.
오류를 발생시키지 않는 조용한 변경 사항
- 기본적으로 비어있는 사고(thinking) 필드. 각
thinking블록은 비어있는thinking필드와signature만 가지고 반환됩니다. 하이쿠 4.5는 요약된 사고를 반환했습니다. 이를 기록하거나 표시하려면thinking: {"type": "adaptive", "display": "summarized"}로 설정하십시오. - 응답이 사고(thinking)로 시작할 수 있음. 적응형 사고는 설정하지 않아도 켜져 있으므로, 인덱스가 아닌
type으로 콘텐츠 블록을 선택하십시오. - 약 30% 더 많은 토큰. 새로운 토크나이저는 동일한 텍스트를 약 30% 더 많은 토큰으로 계산합니다. 프롬프트를 다시 세고, 사고(thinking) 토큰이
max_tokens에 포함되므로 작은 제한은 텍스트가 나오기도 전에stop_reason: "max_tokens"로 멈출 수 있음을 기억하십시오. - 강제
tool_choice는 사고(thinking)를 건너뜀.any또는 지정된 도구는 여전히 작동하지만, 응답은 도구 호출로 시작하며thinking블록이 없습니다. 모델이 먼저 추론하도록 하려면tool_choice: {"type": "auto"}를 사용하고 도구를 호출할 시점을 모델에 알려주세요. - 새로운 거부, 대체 없음. 하이쿠 5.5는
stop_reason: "refusal"을 반환할 수 있는 안전 분류기(`cyber`, `frontier_llm`, `bio`, `general_harms`)를 실행합니다. 서버 측 대체 기능은 없으며, 재시도는 일반적으로 다시 거부됩니다. - 우선순위 티어(Priority Tier)가 사라짐. 하이쿠 4.5에 우선순위 티어 약정이 있다면, 용량을 별도로 계획하십시오.
- 사고(thinking) 블록은 계정 귀속. 이 블록은 생성한 계정 또는 연결된 계정에서만 작동합니다. 다른 계정을 통해 저장된 대화를 재생하면 해당 추론이 손실됩니다.
- 더 저렴한 캐싱이 더 빨리 시작됨. 최소 캐시 가능 프롬프트가 4,096토큰에서 512토큰으로 줄어들어, 4.5에서는 캐시되지 않던 짧은 시스템 프롬프트도 이제 캐시됩니다.
개선된 사항
다음은 최대 노력(max effort) 상태의 하이쿠 5.5에 대한 Anthropic 보고 수치입니다. Artificial Analysis는 GDPval-AA와 AA-Briefcase를 독립적으로 실행했습니다.
| 벤치마크 | 하이쿠 4.5 | 하이쿠 5.5 |
|---|---|---|
| GDPval-AA v2.1 (엘로) | 735 | 1620 |
| AA-Briefcase v1.1 (엘로) | 614 | 1578 |
| OSWorld 2.1, 오프라인 서브셋 | 15.7% | 72.4% |
| Humanity’s Last Exam, 도구 포함 | 18.7% | 57.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| SWE-bench 다국어 | 67.4% | 83.7% |
| Chartography, 도구 없음 | 6.4% | 46.4% |
하이쿠 4.5의 Terminal-Bench 실행은 고정된 63,999 토큰 사고(thinking) 예산을 사용했습니다. 기본 medium 노력 수준에서 하이쿠 5.5는 GDPval-AA에서 1277점을 기록하여 여전히 4.5보다 훨씬 높습니다. Box는 하이쿠 4.5보다 약 절반의 지연 시간으로 11점 더 높은 점수를 보고했습니다. 전체 표는 클로드 하이쿠 5.5 벤치마크에서 확인할 수 있습니다.
Anthropic은 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 더 나은 선택이라고 여전히 강조합니다. 하이쿠 5.5는 분류, 추출, 요약, 압축, 서브 에이전트 및 브라우저 사용을 목표로 합니다.
비용 면에서 Anthropic은 하이쿠 5.5가 평균적으로 약 75% 더 저렴하다고 말합니다. 이 수치는 10만 토큰까지 90% 낮은 가격과 그 이상에서는 50% 낮은 가격을 통합한 것이며, 새로운 토크나이저로 인한 추가 토큰을 이미 상쇄한 것입니다. 도구 사용 시스템 프롬프트도 auto 도구 선택 시 496토큰에서 286토큰으로 줄었습니다. 실제 예시는 클로드 하이쿠 5.5 가격에서 확인할 수 있습니다.
Apidog에서 마이그레이션 테스트하기
Apidog에서 https://api.anthropic.com/v1/messages로 세 가지 저장된 요청을 포함하는 프로젝트를 생성하십시오.

- 기준선(Baseline): 현재 하이쿠 4.5 본문. 상태 200을 단언(assert)합니다.
- 이전 본문, 새 모델:
model만claude-haiku-5-5로 변경합니다. 상태 400을 단언합니다. 발생하는 파괴적 변경 사항마다 하나씩 복사본을 보관하십시오. - 마이그레이션됨: 수정된 본문. 상태 200,
refusal또는max_tokens가 아닌stop_reason, 그리고type으로 찾은 텍스트 블록을 단언합니다.
ANTHROPIC_API_KEY를 환경 변수로 저장하고 x-api-key 헤더에서 {{ANTHROPIC_API_KEY}}로 참조하며, anthropic-version: 2023-06-01을 사용하십시오. 기준선 요청과 마이그레이션된 요청 간의 usage.input_tokens를 비교하여 사용자 프롬프트에서 토크나이저 변경 사항을 확인하십시오. 이 세트를 테스트 시나리오로 저장하면, temperature를 다시 도입하는 팀원이 프로덕션 대신 실행을 실패하게 됩니다. 요청의 기본 사항은 클로드 하이쿠 5.5 API 사용 방법에서 확인할 수 있습니다.
클로드 코드에서 작업하는 경우, /claude-api migrate this project to claude-haiku-5-5를 사용하면 모델 ID 스왑 및 파라미터 수정이 적용된 후 체크리스트가 제공됩니다. haiku 별칭은 Anthropic API에서만 하이쿠 5.5로 해석된다는 점에 유의하십시오. 자세한 내용은 클로드 코드의 클로드 하이쿠 5.5를 참조하십시오.
자주 묻는 질문 (FAQ)
클로드 하이쿠 4.5는 더 이상 사용되지 않나요? 아니요. 사용 중단 날짜 없이 활성 상태로 표시되어 있으며, 2026년 10월 15일 이전에 단종되지 않습니다.
하이쿠 4.5 요청이 하이쿠 5.5에서 400 오류를 반환하는 이유는 무엇인가요? budget_tokens, temperature/top_p/top_k, 어시스턴트 프리필, computer_20250124, 또는 사고(thinking) 블록 이전의 이전 턴 편집이 있는지 확인하십시오. 이들이 5가지 파괴적 변경 사항입니다.
긴 프롬프트의 경우 하이쿠 5.5가 하이쿠 4.5보다 저렴한가요? 네. 10만 토큰을 초과하면 백만 개당 $0.50/$2.50로, 하이쿠 4.5의 $1/$5의 절반 가격입니다. 하이쿠 4.5는 20만 토큰을 초과하는 프롬프트를 전혀 처리할 수 없습니다.
모든 것을 하이쿠 5.5로 전환해야 할까요? 분류, 추출 및 서브 에이전트 작업의 경우 먼저 테스트한 다음 전환하십시오. 하이쿠 5.5 vs GPT-6 루나에서 가장 가까운 경쟁 모델과 비교해 보세요.
다음 단계
하이쿠 4.5 요청을 하이쿠 5.5 쌍 옆에 저장하고, 400 오류를 확인하고, 수정한 후 마이그레이션된 요청이 통과되면 트래픽을 전환하십시오. 해당 테스트 쌍을 구축하려면 Apidog를 다운로드하십시오.
