클로드 하이쿠 5.5 vs 하이쿠 4.5: 달라진 점과 최우선 해결할 대규모 변경 사항

하이쿠 5.5 대 하이쿠 4.5: 10만 토큰까지 90% 저렴, 100만 컨텍스트, 그리고 400번대 오류를 반환하는 다섯 가지 파괴적 변경사항. JSON 수정 전/후 비교 내용 포함.

Medy Evrard

8 October 2026

클로드 하이쿠 5.5 vs 하이쿠 4.5: 달라진 점과 최우선 해결할 대규모 변경 사항

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

클로드 하이쿠 5.5(`claude-haiku-5-5`, 2026년 10월 7일 출시)는 최대 10만 토큰 프롬프트의 경우 하이쿠 4.5보다 90% 저렴합니다(입력/출력 토큰 백만 개당 $0.10/$0.50 대 $1/$5). 컨텍스트 창은 20만 토큰 대신 100만 토큰이며, 두 모델이 모두 포함된 모든 출시 벤치마크에서 훨씬 더 높은 점수를 기록했습니다. 단점은 4.5에서 작동하던 5가지 요청 형태가 이제 400 오류를 반환하며, 몇 가지 추가 변경 사항은 오류 없이 응답과 비용을 변경한다는 것입니다.

아래에는 하이쿠 4.5와 5.5를 비교하는 표, JSON 이전/이후를 보여주는 각 파괴적 변경 사항, 조용한 변경 사항, 그리고 Apidog용 테스트 계획이 있습니다. 전체 사양표를 보려면 클로드 하이쿠 5.5란 무엇인가를 읽어보세요. 이전 모델을 계속 사용 중이라면 클로드 하이쿠 4.5 API 가이드를 참조하십시오.

버튼

하이쿠 4.5 vs 하이쿠 5.5 한눈에 보기

클로드 하이쿠 4.5 클로드 하이쿠 5.5
모델 ID (클로드 API) claude-haiku-4-5-20251001 claude-haiku-5-5
컨텍스트 / 최대 출력 200K / 64K 1M / 128K
MTok당 입력 / 출력 $1 / $5 10만 토큰 이하 프롬프트의 경우 $0.10 / $0.50; 초과 시 $0.50 / $2.50
MTok당 캐시 읽기 / 5분 쓰기 $0.10 / $1.25 10만 토큰 이하의 경우 $0.01 / $0.125; 초과 시 $0.05 / $0.625
MTok당 배치 입력 / 출력 $0.50 / $2.50 10만 토큰 이하의 경우 $0.05 / $0.25; 초과 시 $0.25 / $1.25
사고 (Thinking) 수동 budget_tokens 적응형만 가능, 기본값으로 켜짐
노력 수준 (Effort levels) 없음 low, medium (기본), high, xhigh, max
최소 캐시 가능 프롬프트 4,096 토큰 512 토큰
토크나이저 구형 동일한 텍스트에 대해 약 30% 더 많은 토큰
비기본 샘플링 파라미터, 프리필 허용됨 400 오류
우선순위 티어 (Priority Tier) 지원됨 지원 안됨
상태 활성, 2026년 10월 15일 이전 단종 없음 활성, 2027년 10월 7일 이전 단종 없음

하이쿠 4.5는 더 이상 사용되지 않는 모델이 아닙니다. 모델 사용 중단 페이지에서는 사용 중단 날짜 없이 활성 상태로 표시되어 있으므로, 사용자 일정에 맞춰 마이그레이션할 수 있습니다. 두 모델의 속도 제한은 동일합니다.

5가지 파괴적 변경 사항

하이쿠 4.5에서 작동하는 본문이 하이쿠 5.5에서는 400 오류를 반환합니다. 하이쿠 5.5 마이그레이션 가이드에 모든 내용이 나와 있습니다.

1. budget_tokens를 사용한 수동 사고(thinking)

하이쿠 5.5는 적응형 사고만 실행합니다. 고정된 예산은 거부됩니다.

// 이전 (하이쿠 4.5)
{
  "model": "claude-haiku-4-5-20251001",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

// 이후 (하이쿠 5.5)
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

이제 노력(effort)이 조절의 핵심입니다. 4.5에서 적은 예산을 사용했다면 더 낮은 노력을 선택하십시오. 여전히 thinking: {"type": "disabled"}를 보낼 수 있지만, high 노력 이하에서만 가능합니다. xhigh 또는 max에서는 이 역시 400 오류를 반환합니다.

2. 샘플링 파라미터

temperature, top_p, top_k를 제거하십시오. 허용되는 유일한 값은 temperature: 1과 top_p: 0.99입니다. top_p: 1, 모든 top_k, 그리고 temperature와 top_p를 함께 보내는 경우를 포함하여 다른 모든 값은 400 오류를 반환합니다.

// 이전 (하이쿠 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "temperature": 0.2, "top_k": 40,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

// 이후 (하이쿠 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

일관된 출력을 위해 낮은 temperature를 사용했다면, 그 의도를 프롬프트로 옮기십시오.

3. 어시스턴트 프리필

모델이 계속할 수 있도록 하는 마지막 어시스턴트 턴은 사고(thinking)가 꺼져 있어도 거부됩니다. messages는 사용자 턴으로 끝내십시오.

// 이전 (하이쿠 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." },
    { "role": "assistant", "content": "{\"sentiment\": \"" }
  ] }

// 이후 (하이쿠 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "system": "Reply with only a JSON object. No preamble.",
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." }
  ] }

엄격한 형식의 경우, 마이그레이션 가이드에서는 구조화된 출력이나 분류를 위한 열거형 필드가 있는 도구를 사용하도록 안내합니다.

4. 컴퓨터 사용: computer_20250124에서 computer_toolset_20260801로

클로드 API 및 Google Cloud에서 하이쿠 5.5는 새로운 툴셋을 통해서만 컴퓨터 사용을 지원합니다. computer-use-2025-01-24 베타 헤더를 제거하고, fine-grained-tool-streaming-2025-05-14를 전송하는 경우 이 역시 제거하십시오. 툴셋과 함께 사용하면 400 오류가 발생합니다.

// 이전 (하이쿠 4.5, 헤더 anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
  "tools": [{ "type": "computer_20250124", "name": "computer",
              "display_width_px": 1280, "display_height_px": 800 }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

// 이후 (하이쿠 5.5, 베타 헤더 없음)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "tools": [{ "type": "computer_toolset_20260801" }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

에이전트 루프도 변경됩니다. input.action 대신 각 tool_use 블록의 name과 toolset_name을 사용하여 디스패치하고, 결과에 toolset_name을 반환하십시오. 하이쿠 5.5는 하이쿠 4.5가 지원하지 않는 브라우저 사용 도구(`browser_toolset_20260801`)도 제공합니다. 더 자세한 내용은 클로드 코드 컴퓨터 사용을 참조하십시오.

5. 사고(thinking) 블록 이전의 이전 턴 편집

하이쿠 5.5 사고(thinking) 블록은 그 이전에 전송된 모든 내용이 변경되지 않은 경우에만 유효합니다. system, tools 또는 이전 메시지를 변경하고 블록을 다시 보내면 400 오류가 발생합니다. 하이쿠 4.5는 이 검사를 실행하지 않았습니다. 여기서는 턴 1에서 "system": "You are a billing agent."를 전송했고 턴 2에서 이를 편집합니다.

// 이전: 시스템 편집 + 사고 블록 재실행 = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent. Be brief.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412." }
  ] }

// 이후: 이전 턴 변경 없음, 새 지시 추가
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412. Be brief." }
  ] }

2026년 8월 31일 00:00 UTC 이전에 생성된 계정의 경우, thinking.block_binding.prefix_mismatch_behavior를 설정한 요청에서만 오류가 나타납니다.

오류를 발생시키지 않는 조용한 변경 사항

개선된 사항

다음은 최대 노력(max effort) 상태의 하이쿠 5.5에 대한 Anthropic 보고 수치입니다. Artificial Analysis는 GDPval-AA와 AA-Briefcase를 독립적으로 실행했습니다.

벤치마크 하이쿠 4.5 하이쿠 5.5
GDPval-AA v2.1 (엘로) 735 1620
AA-Briefcase v1.1 (엘로) 614 1578
OSWorld 2.1, 오프라인 서브셋 15.7% 72.4%
Humanity’s Last Exam, 도구 포함 18.7% 57.4%
Terminal-Bench 4.0 0.0% 39.2%
SWE-bench 다국어 67.4% 83.7%
Chartography, 도구 없음 6.4% 46.4%

하이쿠 4.5의 Terminal-Bench 실행은 고정된 63,999 토큰 사고(thinking) 예산을 사용했습니다. 기본 medium 노력 수준에서 하이쿠 5.5는 GDPval-AA에서 1277점을 기록하여 여전히 4.5보다 훨씬 높습니다. Box는 하이쿠 4.5보다 약 절반의 지연 시간으로 11점 더 높은 점수를 보고했습니다. 전체 표는 클로드 하이쿠 5.5 벤치마크에서 확인할 수 있습니다.

Anthropic은 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 더 나은 선택이라고 여전히 강조합니다. 하이쿠 5.5는 분류, 추출, 요약, 압축, 서브 에이전트 및 브라우저 사용을 목표로 합니다.

비용 면에서 Anthropic은 하이쿠 5.5가 평균적으로 약 75% 더 저렴하다고 말합니다. 이 수치는 10만 토큰까지 90% 낮은 가격과 그 이상에서는 50% 낮은 가격을 통합한 것이며, 새로운 토크나이저로 인한 추가 토큰을 이미 상쇄한 것입니다. 도구 사용 시스템 프롬프트도 auto 도구 선택 시 496토큰에서 286토큰으로 줄었습니다. 실제 예시는 클로드 하이쿠 5.5 가격에서 확인할 수 있습니다.

Apidog에서 마이그레이션 테스트하기

Apidog에서 https://api.anthropic.com/v1/messages로 세 가지 저장된 요청을 포함하는 프로젝트를 생성하십시오.

  1. 기준선(Baseline): 현재 하이쿠 4.5 본문. 상태 200을 단언(assert)합니다.
  2. 이전 본문, 새 모델: model만 claude-haiku-5-5로 변경합니다. 상태 400을 단언합니다. 발생하는 파괴적 변경 사항마다 하나씩 복사본을 보관하십시오.
  3. 마이그레이션됨: 수정된 본문. 상태 200, refusal 또는 max_tokens가 아닌 stop_reason, 그리고 type으로 찾은 텍스트 블록을 단언합니다.

ANTHROPIC_API_KEY를 환경 변수로 저장하고 x-api-key 헤더에서 {{ANTHROPIC_API_KEY}}로 참조하며, anthropic-version: 2023-06-01을 사용하십시오. 기준선 요청과 마이그레이션된 요청 간의 usage.input_tokens를 비교하여 사용자 프롬프트에서 토크나이저 변경 사항을 확인하십시오. 이 세트를 테스트 시나리오로 저장하면, temperature를 다시 도입하는 팀원이 프로덕션 대신 실행을 실패하게 됩니다. 요청의 기본 사항은 클로드 하이쿠 5.5 API 사용 방법에서 확인할 수 있습니다.

클로드 코드에서 작업하는 경우, /claude-api migrate this project to claude-haiku-5-5를 사용하면 모델 ID 스왑 및 파라미터 수정이 적용된 후 체크리스트가 제공됩니다. haiku 별칭은 Anthropic API에서만 하이쿠 5.5로 해석된다는 점에 유의하십시오. 자세한 내용은 클로드 코드의 클로드 하이쿠 5.5를 참조하십시오.

자주 묻는 질문 (FAQ)

클로드 하이쿠 4.5는 더 이상 사용되지 않나요? 아니요. 사용 중단 날짜 없이 활성 상태로 표시되어 있으며, 2026년 10월 15일 이전에 단종되지 않습니다.

하이쿠 4.5 요청이 하이쿠 5.5에서 400 오류를 반환하는 이유는 무엇인가요? budget_tokens, temperature/top_p/top_k, 어시스턴트 프리필, computer_20250124, 또는 사고(thinking) 블록 이전의 이전 턴 편집이 있는지 확인하십시오. 이들이 5가지 파괴적 변경 사항입니다.

긴 프롬프트의 경우 하이쿠 5.5가 하이쿠 4.5보다 저렴한가요? 네. 10만 토큰을 초과하면 백만 개당 $0.50/$2.50로, 하이쿠 4.5의 $1/$5의 절반 가격입니다. 하이쿠 4.5는 20만 토큰을 초과하는 프롬프트를 전혀 처리할 수 없습니다.

모든 것을 하이쿠 5.5로 전환해야 할까요? 분류, 추출 및 서브 에이전트 작업의 경우 먼저 테스트한 다음 전환하십시오. 하이쿠 5.5 vs GPT-6 루나에서 가장 가까운 경쟁 모델과 비교해 보세요.

다음 단계

하이쿠 4.5 요청을 하이쿠 5.5 쌍 옆에 저장하고, 400 오류를 확인하고, 수정한 후 마이그레이션된 요청이 통과되면 트래픽을 전환하십시오. 해당 테스트 쌍을 구축하려면 Apidog를 다운로드하십시오.

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요