클로드 하이쿠 5.5 이란?

클로드 하이쿠 5.5는 무엇인가요? Anthropic의 2026년 10월 7일 모델: 최대 10만 토큰 프롬프트 기준 0.10달러/0.50달러, 100만 컨텍스트, 벤치마크, 그리고 하이쿠 4.5와의 변경 사항.

Ashley Innocent

Ashley Innocent

8 October 2026

클로드 하이쿠 5.5 이란?

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

Claude Haiku 5.5는 Anthropic의 현재 모델 중 가장 작고 빠른 모델로, 2026년 10월 7일에 claude-haiku-5-5 API ID로 출시되었습니다. 이 모델은 10만 토큰까지의 프롬프트에 대해 입력 토큰 100만 개당 $0.10, 출력 토큰 100만 개당 $0.50의 비용이 들며, 10만 토큰을 초과하는 프롬프트의 경우 $0.50/$2.50의 비용이 듭니다. Anthropic은 출시 게시물에서 평균적으로 Haiku 4.5보다 "운영 비용이 약 75% 적게 든다"고 밝혔으며, "현재까지 가장 빠른 모델"이라고 설명했습니다. 또한 노력 설정이 적용된 최초의 Haiku 모델이며, 100만 토큰 컨텍스트 창을 제공합니다.

아래 내용: 사양, 이중 가격, Haiku 4.5와의 변경 사항, 벤치마크, 실행 위치 및 전환 대상에 대한 정보와 함께 Haiku 5.5 가격 분석과 같은 심층 가이드 링크가 제공됩니다. 이 모델을 읽으면서 호출하려면 Apidog을(를) 사용하여 Messages 요청을 보내고, 환경 변수에 키를 저장하며, 응답을 토큰 사용량 옆에 표시할 수 있습니다.

버튼

Claude Haiku 5.5 사양 요약

사양 Claude Haiku 5.5
출시일 2026년 10월 7일
모델 ID (Claude API, Google Cloud, Microsoft Foundry, AWS의 Claude Platform) claude-haiku-5-5 (고정 ID, 날짜 접미사 없음)
모델 ID (Amazon Bedrock) anthropic.claude-haiku-5-5
컨텍스트 창 100만 토큰 (Haiku 4.5: 20만 토큰)
최대 출력 128K (Haiku 4.5: 64K); 배치 API에서 output-300k-2026-03-24 베타 헤더 사용 시 300K
사고 방식 적응형만 가능
노력 수준 low, medium (기본), high, xhigh, max
지식 마감일 2026년 6월
MTok당 가격, 10만 토큰까지의 프롬프트 입력 $0.10, 출력 $0.50
MTok당 가격, 10만 토큰 초과 프롬프트 입력 $0.50, 출력 $2.50
단종 예정일 2027년 10월 7일 이전 아님

Claude 라인업에서 Haiku 5.5의 위치

모델 MTok당 입력 / 출력 기본 노력 지연 시간
Claude Fable 5.1 $10 / $50 높음 느림
Claude Opus 5.5 $4 / $20 중간 보통
Claude Sonnet 5.5 $2 / $10 높음 빠름
Claude Haiku 5.5 10만 토큰까지의 프롬프트에 대해 $0.10 / $0.50 중간 가장 빠름

네 가지 모델 모두 100만 토큰 컨텍스트 창, 128K 최대 출력 및 2026년 6월 지식 마감일을 공유합니다. Anthropic은 Haiku 5.5를 분류, 추출, 라우팅과 같은 "대량의 지연 시간에 민감한 작업"뿐만 아니라 요약, 실시간 지원, 브라우저 사용 및 Opus 5.5 또는 Sonnet 5.5 하위 에이전트 작업을 위해 개발했습니다.

속도 주장은 각주가 있습니다: "각 모델의 표준 속도"에서 가장 빠르지만, Fast 모드에서는 Opus보다 느립니다. Anthropic은 초당 토큰 수를 공개하지 않습니다.

Claude Haiku 5.5 가격

가격은 프롬프트 길이에 따라 다릅니다. 100,000 토큰을 초과하는 프롬프트에는 더 높은 요율이 적용됩니다.

출처: Claude API 가격.

"약 75% 저렴"하다는 수치는 평균치입니다. 10만 토큰까지의 프롬프트는 Haiku 4.5보다 90% 저렴하고, 그 이상은 50% 저렴하며, Haiku 4.5 요청의 90%가 이 임계값 미만이었습니다. 이는 동일한 텍스트에 대해 약 30% 더 많은 토큰을 생성하는 새로운 토크나이저를 이미 반영한 수치입니다.

미국 전용 추론(inference_geo)은 모든 토큰 범주에서 1.1배의 비용이 듭니다. 최소 캐싱 가능한 프롬프트는 Haiku 4.5의 4,096토큰에서 512토큰으로 감소했습니다.

10만 토큰 미만에서 정가는 GPT-6 Luna와 정확히 일치합니다(입력 $0.10, 출력 $0.50, 캐시 읽기 $0.01, 캐시 쓰기 $0.125). 임계값은 다릅니다. Luna의 할증료는 27만 2천 입력 토큰을 초과할 때부터 시작됩니다. Haiku 5.5 대 GPT-6 Luna 비교에서 이러한 차이점을 다루며, 가격 가이드에는 비용 예시가 나와 있습니다.

Haiku 4.5에서 변경된 사항

컨텍스트 창이 5배 확장되고, 최대 출력이 2배 증가하며, 처음으로 노력 제어 기능을 사용할 수 있습니다. 마이그레이션 가이드는 Haiku 4.5용으로 작성된 코드가 작동하지 않을 수 있다고 경고합니다. 다음 다섯 가지 변경 사항은 400 오류를 반환합니다:

  1. 수동 사고 예산. thinking: {"type": "enabled", "budget_tokens": N}은(는) 실패합니다. output_config.effort와 함께 {"type": "adaptive"}를 사용하세요.
  2. 샘플링 매개변수. temperature, top_p, top_k를 제거하세요. 기본값이 아닌 temperature 또는 top_p 값은 실패하며, 모든 top_k 또는 temperature와 top_p를 동시에 보내는 것도 실패합니다.
  3. 어시스턴트 사전 채우기. 사고 기능이 꺼져 있어도 거부됩니다.
  4. 이전 컴퓨터 사용 도구. Claude API 및 Google Cloud에서는 computer_toolset_20260801을(를) 사용하세요. computer_20250124는 실패합니다.
  5. 편집된 기록. 반환된 사고 블록 이전에 system, tools 또는 이전 메시지를 변경하면 실패합니다. 대화는 추가 전용으로 유지하세요.

다른 변경 사항은 오류를 발생시키지 않지만 결과에 영향을 미칩니다:

API에서 high 노력 수준 이하에서는 사고 기능을 비활성화할 수 있습니다. xhigh 및 max에서는 400 오류를 반환합니다. Haiku 4.5는 더 이상 사용되지 않는 것이 아니며, 여전히 활성 상태로 나열되어 있습니다. Haiku 5.5 대 Haiku 4.5 가이드에는 각 수정 사항에 대한 전후 JSON이 포함되어 있습니다.

Claude Haiku 5.5 벤치마크

Haiku 5.5 점수는 최대 노력으로, 주로 5번의 시도에 대한 평균치입니다. Artificial Analysis는 GDPval-AA 및 AA-Briefcase를 실행했고, Cognition은 FrontierCode를 실행했으며, Anthropic은 자체 구현을 통해 Chartography(Surge AI 벤치마크)를 평가했습니다.

세 개의 셀을 주의 깊게 읽으세요. FrontierCode는 Haiku를 최대 노력으로, Sonnet 5.5를 xhigh 노력으로 비교했습니다. 최대 노력에서 Sonnet은 46.2%를 기록하여 Haiku의 46.4%보다 낮았습니다. Anthropic은 OpenAI의 API를 통해 Luna의 OSWorld 점수를 실행했으며, Luna의 Terminal-Bench 점수는 공개 리더보드(Codex CLI)에서 가져왔습니다. 그리고 기본 medium 노력 수준에서 Haiku 5.5는 GDPval-AA에서 1277점, AA-Briefcase에서 1372점을 기록했습니다.

Anthropic은 Sonnet 5.5 및 Opus 5.5가 "복잡한 에이전트 코딩 작업에 더 나은 선택으로 남아 있다"고 말합니다. 2026년 10월 8일 현재 어떤 독립적인 리더보드에도 Haiku 5.5 결과는 없었습니다. Cursor는 자체 CursorBench에서 최대 노력으로 48.4%를 기록했다고 보고합니다. 벤치마크 심층 분석에는 노력 수준별 점수와 비용이 포함되어 있습니다.

Claude Haiku 5.5 사용처

플랫폼 접근 방식 참고 사항
Claude API claude-haiku-5-5 토큰당 지불
Amazon Bedrock anthropic.claude-haiku-5-5 AWS Marketplace를 통해 청구
Google Cloud, Microsoft Foundry, AWS의 Claude Platform claude-haiku-5-5 Claude API와 동일한 ID
Claude.ai (웹, iOS, Android) 모델 선택기 무료, Pro, Max, Team 및 Enterprise 사용자가 선택 가능
Claude Code /model claude-haiku-5-5 v2.1.293 이상; 유료 플랜
Vercel AI Gateway anthropic/claude-haiku-5.5 $0.10 / $0.50부터
Cursor claude-haiku-5-5 다른 모델 풀

2026년 10월 8일 현재, OpenRouter에는 없으며 GitHub Copilot용으로 발표되지도 않았습니다.

무료 플랜의 채팅 접근은 API 키가 아니며, API는 Anthropic이 신규 사용자에게 테스트를 위해 제공하는 소량의 무료 크레딧을 초과하면 사용량에 따라 비용을 지불해야 합니다. Max 및 Team 플랜에는 이제 월별 API 크레딧(Max 5x에서 $100, Max 20x에서 $200, Team에서 최대 $500까지 통합)이 포함되지만, 이는 Claude Code에는 적용되지 않습니다. 무료 접근 가이드에는 무료 및 비무료 항목이 나열되어 있습니다.

Claude Code에서 haiku 별칭은 Anthropic API에서만 Haiku 5.5를 의미합니다. 다른 곳에서는 여전히 Haiku 4.5를 의미합니다. 하위 에이전트 설정에 대해서는 Claude Code의 Haiku 5.5를 참조하세요.

Haiku 5.5로 전환해야 하는 사람

Anthropic의 출시 게시물에서 Asana는 작업 완료 지연 시간이 30% 이상 감소했다고 보고했으며, Box는 Haiku 4.5보다 11점 높은 점수를 약 절반의 지연 시간으로 얻었다고 보았습니다. 이는 고객의 주장이며 독립적인 테스트 결과는 아닙니다.

시스템 카드에는 Anthropic의 자동 감사에서 다른 어떤 모델보다 과도하게 거부했다는 점이 명시되어 있으므로, 사용자 자신의 프롬프트에서 거부율을 테스트해 보세요.

첫 번째 Haiku 5.5 요청 보내기

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
    ]
  }'

샘플링 매개변수와 사전 채우기를 생략하세요. 응답이 사고 블록으로 시작될 수 있으므로 type별로 콘텐츠 블록을 읽으세요.

Apidog에서 curl 명령을 새 요청으로 가져오고 ANTHROPIC_API_KEY 환경 변수에 키를 저장하세요. stop_reason이 refusal 또는 max_tokens가 아니라는 어설션을 추가하세요. 그런 다음 medium으로 요청을 복제하고 usage를 비교하여 각 노력 수준의 비용을 확인하세요. Haiku 5.5 API 가이드는 캐싱, 배치 및 스트리밍을 다루며, Anthropic API 키 가이드는 키가 필요한 경우 도움을 줍니다.

자주 묻는 질문

Claude Haiku 5.5는 언제 출시되었습니까? 2026년 10월 7일, Sonnet 5.5 출시 9일 후입니다.

Claude Haiku 5.5는 무료입니까? Claude.ai 채팅 앱에서는 무료 사용자가 선택할 수 있습니다. API는 신규 사용자를 위한 소량의 테스트 크레딧을 제외하고는 유료입니다. 모든 무료 경로를 참조하세요.

Claude Haiku 5.5 컨텍스트 창은 얼마입니까? Messages API에서 100만 토큰이며, 최대 출력은 128K입니다.

Haiku 4.5는 단종됩니까? 아직 아닙니다. 여전히 활성 상태로 나열되어 있으며, 2026년 10월 15일 이전에는 단종되지 않습니다.

다음 단계

오늘 실행하는 티켓 분류 또는 문서 요약과 같은 대량 작업 하나를 선택하세요. 이를 low 및 medium 노력 수준으로 claude-haiku-5-5에 보내고, 출력을 확인한 다음 현재 모델과 usage를 비교하세요. 요청 및 어설션을 하나의 프로젝트에 보관하려면 Apidog을(를) 다운로드하고, 가격 가이드를 사용하여 토큰 수를 월별 청구액으로 전환하세요.

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요