Claude Code에서 Claude Haiku 5.5를 사용하려면 claude update를 사용하여 v2.1.293 이상으로 업데이트한 다음, claude --model claude-haiku-5-5로 세션을 시작하거나 세션 내에서 /model claude-haiku-5-5를 실행하십시오. 대부분의 사용자에게 더 큰 이점은 서브에이전트로 실행하는 것입니다: 서브에이전트 파일에 model: haiku를 넣고 Sonnet 5.5 또는 Opus 5.5가 검색, 테스트 실행 및 요약을 처리하도록 하십시오. API 키가 있으면 최대 100K 토큰 프롬프트의 경우 백만 입력/출력 토큰당 $0.10/$0.50이며, 그 이상은 $0.50/$2.50입니다.
아래 내용: 설정, haiku 별칭 함정, 노력 수준, 서브에이전트 파일, 100K 가격 단계, Sonnet 또는 Opus가 주도해야 할 때. 모델 자체에 대해서는 Claude Haiku 5.5란 무엇인가를 읽어보십시오. 코드가 API를 호출하는 경우, Apidog는 Haiku 서브에이전트가 실행할 수 있는 테스트 시나리오를 보유하고 있습니다.

Claude Code에서 Claude Haiku 5.5 한눈에 보기
| 설정 | Haiku 5.5 |
|---|---|
| 최소 버전 | v2.1.293 (claude update) |
| 모델 ID | claude-haiku-5-5 |
haiku 별칭 |
Anthropic API의 Haiku 5.5만 해당 |
| 컨텍스트 | 모든 플랜에서 1M 기본, [1m] 접미사 없음 |
| 자동 압축 | 기본적으로 약 967K 토큰 |
| 기본 노력 수준 | medium (low에서 max까지) |
| 사고 기능 (Thinking) | 항상 켜져 있음; 끌 수 없음 |
| API 가격 | 최대 100K 토큰 프롬프트에 $0.10/$0.50; 100K 초과 시 $0.50/$2.50 |
| 플랜 | Pro, Max, Team, Enterprise 또는 API 키; 무료 플랜 불가 |
1단계: Claude Code 업데이트
Haiku 5.5는 Claude Code v2.1.293 이상이 필요합니다. 변경로그 항목은 이를 "현재 Anthropic API의 기본 Haiku 모델"이라고 부릅니다.
claude update
Claude Code는 무료 플랜에서 사용할 수 없습니다. 무료 사용자는 Claude.ai 앱에서 Haiku 5.5를 선택할 수 있지만, Claude Code는 Pro, Max, Team, Enterprise 또는 Anthropic API 키가 필요합니다. claude.com/pricing에 따르면, Pro는 연간 청구 시 월 $17 또는 월 $20이며, Max는 $100부터 시작합니다.
2단계: Haiku 5.5를 주 모델로 선택
claude --model claude-haiku-5-5
실행 중인 세션 내에서 /model claude-haiku-5-5도 동일한 작업을 수행합니다. 저장된 model 설정이 haiku인 경우, Haiku 4.5에서 저장된 세션은 Haiku 5.5에서 다시 시작됩니다.
haiku 별칭은 Anthropic API의 Haiku 5.5만 의미합니다
| 제공업체 | haiku는 다음으로 해석됨 |
|---|---|
| Anthropic API | Haiku 5.5 |
| AWS의 Claude Platform | Haiku 4.5 |
| Amazon Bedrock, Google Cloud의 Agent Platform | Haiku 4.5 |
| Microsoft Foundry | Haiku 4.5 |
어떤 클라우드 제공업체에서든, 서브에이전트 파일에서 /model haiku 및 model: haiku는 Haiku 4.5를 제공합니다. 대신 전체 ID를 고정하십시오: Google Cloud 및 AWS의 Claude Platform에서는 claude-haiku-5-5, Foundry에서는 배포 이름, Amazon Bedrock에서는 us.anthropic.claude-haiku-5-5와 같은 추론 프로필 ID. 또는 ANTHROPIC_DEFAULT_HAIKU_MODEL(5단계)로 별칭을 지정하십시오.
3단계: 노력 수준 선택
Haiku 5.5는 노력 수준 제어가 가능한 첫 번째 Haiku입니다: Claude Code에서는 medium에서 시작하여 low, medium, high, xhigh, max가 있습니다.
claude --model claude-haiku-5-5 --effort high
세션 내에서 /effort low는 현재 모델에 대한 수준을 저장합니다. Anthropic의 프롬프트 가이드는 짧은 도구 작업 및 고용량 요청에 low를, 대부분의 작업에 medium을, 긴 에이전트 작업에 high를 제안합니다. 평가에서 이득이 확인되는 작업에는 xhigh 및 max를 아껴두십시오.
사고 기능(Thinking)은 계속 켜져 있습니다. Claude Code의 Haiku 5.5에서는 끌 수 없습니다; alwaysThinkingEnabled: false 및 MAX_THINKING_TOKENS=0는 효과가 없습니다. (원시 Messages API는 high 이하에서 비활성화할 수 있습니다.) 사고 토큰을 줄이고 싶을 때는 노력 수준을 낮추십시오.
4단계: Haiku 5.5를 서브에이전트로 실행
Anthropic은 Haiku 5.5가 "코딩 작업에서 Opus 5.5 및 Sonnet 5.5와 서브에이전트로서 잘 어울린다"고 말합니다. 서브에이전트는 .claude/agents/ (프로젝트) 또는 ~/.claude/agents/ (모든 프로젝트)에 YAML 프론트매터가 있는 Markdown 파일입니다. name과 description만 필수이며, 서브에이전트 문서는 model에 대해 sonnet, opus, haiku, fable, 전체 모델 ID 또는 inherit를 허용합니다. 서브에이전트 가이드는 범위와 도구를 다룹니다.
Explore를 저렴한 탐색기로 교체
내장된 Explore 서브에이전트는 Haiku가 아닌 주 대화의 모델에서 실행됩니다. Opus 5.5 세션에서는 모든 Explore 검색이 Opus에서 실행됩니다. Explore라는 사용자 또는 프로젝트 서브에이전트는 내장된 서브에이전트를 재정의하고 자체 model을 유지합니다:
---
name: Explore
description: 빠르고 읽기 전용 코드베이스 검색. 아무것도 편집하지 않고 파일, 심볼 및 호출 사이트를 찾을 때 사용합니다.
tools: Read, Grep, Glob
model: haiku
effort: low
---
코드베이스를 검색하고 찾은 내용을 보고합니다. 줄 번호와 각 일치 항목에 대한 짧은 요약을 포함한 파일 경로를 반환합니다. 파일을 절대 편집하지 마십시오.
이를 .claude/agents/Explore.md로 저장하십시오. 모델을 확인하려면 작업 중일 때 /tasks를 실행하십시오. 클라우드 제공업체에서는 haiku를 2단계의 전체 ID로 바꾸십시오.
모든 서브에이전트를 Haiku로 강제 설정
Explore를 포함하여 모든 서브에이전트를 Haiku에서 실행하려면, 설정 파일의 env 블록에 두 변수를 모두 설정하십시오:
{
"env": {
"CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
"CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
}
}
CLAUDE_CODE_SUBAGENT_MODEL만으로는 기본값으로 작동합니다: 서브에이전트 자체의 model 필드가 여전히 우선하며, Explore는 이동하지 않습니다.
5단계: 백그라운드 작업을 Haiku 5.5로 지정
ANTHROPIC_DEFAULT_HAIKU_MODEL은 haiku 또는 claude --resume과 같은 백그라운드 기능을 위해 사용할 모델을 설정합니다. 이전의 ANTHROPIC_SMALL_FAST_MODEL은 환경 변수 참조에 따라 더 이상 사용되지 않습니다. 셸 프로필이 여전히 이를 설정하는 경우 교체하십시오.
Anthropic API에서는 아무것도 설정할 필요가 없습니다. Google Cloud에서는 백그라운드 작업이 기본적으로 Sonnet으로 설정됩니다. Foundry에서는 기본 모델로, Bedrock에서는 Sonnet 또는 기본 모델로 설정됩니다. Haiku 5.5가 계정에서 활성화되면 이를 고정하십시오:
# Google Cloud의 Agent Platform
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5
# Amazon Bedrock (추론 프로필 ID)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
긴 세션에서의 100K 가격 단계
Haiku 5.5의 가격은 프롬프트 길이에 따라 달라지며, Claude Code는 매 턴마다 대화를 프롬프트로 보냅니다. 세션 컨텍스트가 100K 토큰을 초과하면 각 요청은 $0.10/$0.50 대신 $0.50/$2.50로 청구되며, 이는 짧은 프롬프트 요율의 5배입니다. 문서에는 캐시된 토큰이 이 한도에 포함되는지 명시되어 있지 않으므로, 포함된다고 가정하고 예산을 책정하십시오.
자동 압축은 도움이 되지 않습니다: Haiku 5.5는 기본적으로 약 967K 토큰에서 압축되므로, 세션은 가격 단계보다 훨씬 높게 실행될 수 있습니다. 토큰당 비용을 지불할 때 두 가지 습관이 도움이 됩니다:
- 더 일찍 압축하십시오.
/autocompact 100k는 Claude Code가 허용하는 가장 낮은 창을 설정하므로, 세션은 1M 근처가 아닌 경계 근처에서 압축됩니다. - 대용량 작업을 서브에이전트로 밀어넣으십시오. 서브에이전트는 자체 컨텍스트를 가지므로, 테스트 로그와 검색 결과가 주 대화에 포함되지 않습니다.
100K를 초과하더라도 $0.50/$2.50은 Sonnet 5.5의 $2/$10의 1/4입니다. 유료 플랜에서는 세션이 사용량 제한을 따르며, Anthropic은 Haiku 5.5가 이러한 제한에 어떻게 계산되는지 게시하지 않았습니다. Haiku 5.5 가격 분석에서 계산법을 자세히 설명합니다.
Max 및 Team 구독자: Anthropic의 API 크레딧 문서에 따르면, 새로운 월별 API 크레딧(Max 5배에 $100, Max 20배에 $200, Team에 최대 $500 풀링)은 대화형 Claude Code를 지원하지 않습니다.
Sonnet 5.5 또는 Opus 5.5를 주 모델로 유지해야 할 때
Anthropic은 Sonnet 5.5와 Opus 5.5가 "복잡한 에이전트 코딩 작업에 더 나은 선택으로 남아있다"고 말합니다. Anthropic이 Claude Code에서 최대 노력으로 실행한 Terminal-Bench 4.0에서 Haiku 5.5는 Sonnet 5.5의 70.6%에 비해 39.2%를 기록했습니다. 출시 차트는 시도당 비용을 추가합니다:
| 노력 수준 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|
medium |
$0.68에 20.3% | $0.68에 28.8% |
high |
$1.04에 24.8% | $1.46에 43% |
max |
$2.64에 39.2% | $10.44에 70.6% |
medium에서는 둘 다 시도당 비용이 거의 같고 Sonnet이 더 높은 점수를 기록합니다. Haiku의 토큰 가격은 긴 셸 작업으로 이어지지 않으므로, 어려운 코딩 세션의 주 모델로 사용하지 마십시오.
컴퓨터 사용은 다른 이야기를 합니다. OSWorld 2.1에서 medium 수준의 Haiku 5.5는 시도당 $0.13에 53.3%를 기록한 반면, low 수준의 Sonnet 5.5는 $0.68에 57.9%를 기록했습니다. Haiku 5.5 벤치마크 분석에는 모든 데이터가 있으며, Sonnet 5.5 Claude Code 가이드는 주 모델 측면을 다룹니다.
실용적인 분할: 주 모델은 Sonnet 5.5 또는 Opus 5.5, Explore, 테스트 실행기, 로그 리더 및 문서 가져오기에는 Haiku 5.5를 사용합니다.
예시: Apidog 테스트를 실행하는 Haiku 서브에이전트
테스트 실행은 장황하고 반복적이므로 Haiku에 적합합니다. Apidog CLI는 터미널에서 저장된 Apidog 테스트 시나리오를 실행하므로, 서브에이전트가 이를 실행하고 짧은 보고서를 다시 제공하는 동안 주 모델의 컨텍스트는 깨끗하게 유지됩니다.
---
name: api-test-runner
description: API 엔드포인트 변경 후 Apidog CLI를 사용하여 프로젝트의 Apidog 테스트 시나리오를 실행한 다음, 실패한 요청과 함께 성공 및 실패 횟수를 보고합니다.
tools: Bash, Read
model: haiku
effort: low
---
변경된 엔드포인트를 다루는 시나리오에 대해 이 저장소의 README에 문서화된 Apidog CLI 테스트 명령을 실행합니다. 성공 및 실패 횟수를 보고합니다. 각 실패에 대해 요청 이름, 예상 결과 및 실제 결과를 제공합니다. 코드를 편집하지 마십시오. 실패한 실행을 한 번 이상 다시 시도하지 마십시오.
인증 및 실행 명령을 포함한 CLI 설정은 Claude Code의 Apidog CLI에 있습니다. 서브에이전트가 실행할 시나리오를 구축하려면 Apidog를 다운로드하십시오.
Haiku 4.5에서 앱 마이그레이션
앱이 API를 통해 Haiku 4.5를 호출하는 경우, Claude Code는 마이그레이션을 시작할 수 있습니다:
/claude-api migrate this project to claude-haiku-5-5
호환성 문제가 예상됩니다: 수동 budget_tokens 사고, 비기본 temperature 또는 top_p, 모든 top_k, 그리고 어시스턴트 사전 채우기는 Haiku 5.5에서 모두 400을 반환합니다. Haiku 5.5 vs Haiku 4.5 가이드는 각 수정 사항을 나열합니다. 편집 후, 이전 및 새 요청을 Apidog에 쌍으로 저장하고, ANTHROPIC_API_KEY를 환경 변수로 저장하고, stop_reason 및 usage에 대해 단언하여 새로운 refusal 중지 또는 토큰 증가가 프로덕션에 도달하는 대신 테스트를 실패하도록 하십시오.
FAQ
Haiku 5.5가 Claude Code의 기본 모델입니까? 아닙니다. Anthropic API의 기본 Haiku 모델이며, 이는 haiku 별칭이 Haiku 5.5를 가리킨다는 의미입니다. --model 또는 /model로 주 모델을 선택하십시오.
무료 플랜에서 Claude Code의 Haiku 5.5를 사용할 수 있습니까? 아닙니다. Claude Code는 유료 플랜 또는 API 키가 필요합니다. 무료 사용자는 Claude.ai 앱에서 Haiku 5.5를 선택할 수 있습니다. Claude Haiku 5.5를 무료로 사용하는 방법을 참조하십시오.
model: haiku가 Haiku 4.5를 제공하는 이유는 무엇입니까? Bedrock, Google Cloud, Foundry 또는 AWS의 Claude Platform을 사용 중이거나 v2.1.293 이전 버전을 사용 중일 수 있습니다. 전체 ID를 고정하거나 ANTHROPIC_DEFAULT_HAIKU_MODEL을 설정하십시오.
토큰을 절약하기 위해 사고 기능을 끌 수 있습니까? Claude Code에서는 불가능합니다. 대신 노력 수준을 낮추십시오. low가 가장 저렴한 설정입니다.
다음 단계
claude update를 실행하고, Haiku Explore 재정의를 추가하고, 현재 주 모델을 일주일 동안 유지하십시오. 그런 다음 프로젝트에 API가 있다면 테스트 실행기 서브에이전트를 추가하십시오. 자체 코드에서 모델을 호출하려면 Haiku 5.5 API 가이드부터 시작하십시오. Apidog는 무료로 시작할 수 있으며 해당 서브에이전트가 실행할 실제 테스트를 제공합니다.
