Pour utiliser Claude Haiku 5.5 dans Claude Code, mettez à jour vers la version v2.1.293 ou ultérieure avec claude update, puis démarrez une session avec claude --model claude-haiku-5-5 ou exécutez /model claude-haiku-5-5 à l'intérieur d'une session. Le plus grand avantage pour la plupart des gens est de l'exécuter en tant que sous-agent : mettez model: haiku dans un fichier de sous-agent et laissez Sonnet 5.5 ou Opus 5.5 lui confier les recherches, les exécutions de tests et les résumés. Avec une clé API, cela coûte 0,10 $/0,50 $ par million de jetons d'entrée/sortie pour les prompts jusqu'à 100K jetons, et 0,50 $/2,50 $ au-delà.
Ci-dessous : configuration, le piège de l'alias haiku, l'effort, les fichiers de sous-agent, le palier de prix de 100K, et quand Sonnet ou Opus devrait être le modèle principal. Pour le modèle lui-même, lisez ce qu'est Claude Haiku 5.5. Si votre code appelle des API, Apidog contient les scénarios de test qu'un sous-agent Haiku peut exécuter pour vous.

Claude Haiku 5.5 dans Claude Code en un coup d'œil
| Paramètre | Haiku 5.5 |
|---|---|
| Version minimale | v2.1.293 (claude update) |
| ID du modèle | claude-haiku-5-5 |
Alias haiku |
Haiku 5.5 sur l'API Anthropic uniquement |
| Contexte | 1M natif sur chaque plan, pas de suffixe [1m] |
| Auto-compaction | Environ 967K jetons par défaut |
| Effort par défaut | medium (niveaux de low à max) |
| Réflexion (Thinking) | Toujours activée ; ne peut pas être désactivée |
| Prix API | 0,10 $/0,50 $ pour les prompts jusqu'à 100K jetons ; 0,50 $/2,50 $ au-delà de 100K |
| Plans | Pro, Max, Team, Enterprise ou une clé API ; pas Gratuit |
Étape 1 : mettre à jour Claude Code
Haiku 5.5 nécessite Claude Code v2.1.293 ou ultérieure. L'entrée du journal des modifications l'appelle « désormais le modèle Haiku par défaut sur l'API Anthropic ».
claude update
Claude Code n'est pas disponible sur le plan gratuit. Les utilisateurs gratuits peuvent sélectionner Haiku 5.5 dans les applications Claude.ai, mais Claude Code nécessite un plan Pro, Max, Team, Enterprise ou une clé API Anthropic. Selon claude.com/pricing, le plan Pro coûte 17 $ par mois facturé annuellement ou 20 $ par mois, et le plan Max commence à 100 $.
Étape 2 : sélectionner Haiku 5.5 comme modèle principal
claude --model claude-haiku-5-5
À l'intérieur d'une session en cours, /model claude-haiku-5-5 fait la même chose. Si votre paramètre model enregistré est haiku, une session enregistrée sur Haiku 4.5 reprendra sur Haiku 5.5.
L'alias haiku ne signifie Haiku 5.5 que sur l'API Anthropic
| Fournisseur | haiku correspond à |
|---|---|
| API Anthropic | Haiku 5.5 |
| Plateforme Claude sur AWS | Haiku 4.5 |
| Amazon Bedrock, Agent Platform de Google Cloud | Haiku 4.5 |
| Microsoft Foundry | Haiku 4.5 |
Sur tout fournisseur cloud, /model haiku et model: haiku dans un fichier de sous-agent vous donnent Haiku 4.5. Épinglez plutôt l'ID complet : claude-haiku-5-5 sur Google Cloud et la plateforme Claude sur AWS, le nom de votre déploiement sur Foundry, et un ID de profil d'inférence tel que us.anthropic.claude-haiku-5-5 sur Amazon Bedrock. Ou pointez l'alias vers celui-ci avec ANTHROPIC_DEFAULT_HAIKU_MODEL (Étape 5).
Étape 3 : choisir un niveau d'effort
Haiku 5.5 est le premier Haiku avec contrôle de l'effort : low, medium, high, xhigh et max, commençant à medium dans Claude Code.
claude --model claude-haiku-5-5 --effort high
Dans une session, /effort low enregistre un niveau pour le modèle actuel. Le guide de prompting d'Anthropic suggère low pour les tâches d'outil courtes et les requêtes à volume élevé, medium pour la plupart des travaux, et high pour les tâches d'agent plus longues. Réservez xhigh et max pour les tâches où vos évaluations montrent un gain.
La réflexion (Thinking) reste activée. Vous ne pouvez pas la désactiver sur Haiku 5.5 dans Claude Code ; alwaysThinkingEnabled: false et MAX_THINKING_TOKENS=0 n'ont aucun effet. (L'API Messages brute peut la désactiver à high ou moins.) Diminuez l'effort lorsque vous souhaitez moins de jetons de réflexion.
Étape 4 : exécuter Haiku 5.5 en tant que sous-agent
Anthropic affirme que Haiku 5.5 « se marie bien avec Opus 5.5 et Sonnet 5.5 en tant que sous-agent pour les tâches de codage ». Les sous-agents sont des fichiers Markdown avec des métadonnées YAML dans .claude/agents/ (projet) ou ~/.claude/agents/ (tous les projets). Seuls name et description sont requis, et la documentation des sous-agents accepte sonnet, opus, haiku, fable, un ID de modèle complet ou inherit pour model. Notre guide des sous-agents couvre les scopes et les outils.
Remplacer Explore par un explorateur économique
Le sous-agent Explore intégré s'exécute sur le modèle de la conversation principale, et non sur Haiku. Dans une session Opus 5.5, chaque recherche Explore s'exécute sur Opus. Un sous-agent utilisateur ou projet nommé Explore remplace l'agent intégré et conserve son propre model :
---
name: Explore
description: Recherche rapide en lecture seule dans la base de code. Permet de trouver des fichiers, des symboles et des sites d'appel sans rien modifier.
tools: Read, Grep, Glob
model: haiku
effort: low
---
Vous recherchez dans la base de code et rapportez ce que vous trouvez. Retournez les chemins de fichiers avec les numéros de ligne et un court résumé de chaque correspondance. Ne modifiez jamais les fichiers.
Enregistrez-le sous .claude/agents/Explore.md. Exécutez /tasks pendant qu'il fonctionne pour confirmer le modèle. Sur un fournisseur cloud, remplacez haiku par l'ID complet de l'étape 2.
Forcer chaque sous-agent à utiliser Haiku
Pour exécuter chaque sous-agent sur Haiku, y compris Explore, définissez les deux variables dans le bloc env d'un fichier de paramètres :
{
"env": {
"CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
"CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
}
}
CLAUDE_CODE_SUBAGENT_MODEL seul est une valeur par défaut : le champ model propre à un sous-agent l'emporte toujours, et Explore ne change pas.
Étape 5 : diriger les tâches de fond vers Haiku 5.5
ANTHROPIC_DEFAULT_HAIKU_MODEL définit « le modèle à utiliser pour haiku, ou les fonctionnalités en arrière-plan », comme la synthèse des sessions passées pour claude --resume. L'ancien ANTHROPIC_SMALL_FAST_MODEL est obsolète, selon la référence des variables d'environnement ; remplacez-le si votre profil shell le définit toujours.
Sur l'API Anthropic, vous n'avez rien à définir. Sur Google Cloud, les tâches de fond par défaut sont Sonnet ; sur Foundry, le modèle principal ; sur Bedrock, Sonnet ou le modèle principal. Une fois que Haiku 5.5 est activé dans votre compte, épinglez-le :
# Plateforme d'agents de Google Cloud
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5
# Amazon Bedrock (ID de profil d'inférence)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
Le palier de prix de 100K dans les sessions longues
Le prix de Haiku 5.5 dépend de la longueur du prompt, et Claude Code envoie la conversation comme prompt à chaque tour. Une fois que le contexte d'une session dépasse 100K jetons, chaque requête est facturée à 0,50 $/2,50 $ au lieu de 0,10 $/0,50 $, soit cinq fois le tarif des prompts courts. La documentation ne précise pas si les jetons mis en cache comptent pour cette ligne, alors prévoyez comme s'ils le faisaient.
L'auto-compaction ne vous sauvera pas : Haiku 5.5 se compacte à environ 967K jetons par défaut, donc une session peut dépasser largement le palier de prix avant. Deux habitudes aident lorsque vous payez par jeton :
- Compacter plus tôt.
/autocompact 100kdéfinit la fenêtre la plus basse acceptée par Claude Code, de sorte que la session se compacte près de la limite au lieu de près de 1M. - Pousser le travail volumineux dans les sous-agents. Un sous-agent a son propre contexte, de sorte que les journaux de test et les résultats de recherche restent en dehors de la conversation principale.
Même au-delà de 100K, 0,50 $/2,50 $ est un quart des 2 $/10 $ de Sonnet 5.5. Sur un plan payant, les sessions utilisent plutôt les limites d'utilisation, et Anthropic n'a pas publié comment Haiku 5.5 est comptabilisé par rapport à celles-ci. Notre répartition des prix de Haiku 5.5 explique l'arithmétique.
Abonnés Max et Team : les nouveaux crédits API mensuels (100 $ sur Max 5x, 200 $ sur Max 20x, jusqu'à 500 $ mutualisés sur Team) ne couvrent pas Claude Code interactif, selon la documentation des crédits API d'Anthropic.
Quand garder Sonnet 5.5 ou Opus 5.5 comme modèle principal
Anthropic affirme que Sonnet 5.5 et Opus 5.5 « restent de meilleurs choix pour les tâches de codage agentique complexes ». Sur Terminal-Bench 4.0, exécuté par Anthropic dans Claude Code à effort maximal, Haiku 5.5 a obtenu un score de 39,2 % contre 70,6 % pour Sonnet 5.5. Les graphiques de lancement ajoutent le coût par tentative :
| Effort | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|
medium |
20,3 % à 0,68 $ | 28,8 % à 0,68 $ |
high |
24,8 % à 1,04 $ | 43 % à 1,46 $ |
max |
39,2 % à 2,64 $ | 70,6 % à 10,44 $ |
À medium, les deux coûtent à peu près le même prix par tentative et Sonnet obtient un score plus élevé. Le prix des jetons de Haiku ne se répercute pas sur les longues sessions de codage, alors ne le mettez pas en tête pour les sessions de codage difficiles.
L'utilisation de l'ordinateur raconte une histoire différente. Sur OSWorld 2.1, Haiku 5.5 à medium a obtenu un score de 53,3 % à 0,13 $ par tentative, tandis que Sonnet 5.5 à low a obtenu un score de 57,9 % à 0,68 $. Notre analyse des benchmarks de Haiku 5.5 contient chaque ligne, et le guide Claude Code de Sonnet 5.5 couvre l'aspect modèle principal.
Une répartition pratique : Sonnet 5.5 ou Opus 5.5 comme modèle principal, Haiku 5.5 pour Explore, les exécuteurs de tests, les lecteurs de journaux et les récupérateurs de documentation.
Exemple : un sous-agent Haiku qui exécute vos tests Apidog
Les exécutions de tests sont verbeuses et répétitives, un bon usage pour Haiku. Le CLI Apidog exécute vos scénarios de test Apidog enregistrés depuis le terminal, de sorte qu'un sous-agent peut les exécuter et renvoyer un rapport court tandis que le contexte du modèle principal reste propre.
---
name: api-test-runner
description: Exécute les scénarios de test Apidog du projet avec le CLI Apidog après la modification d'un point de terminaison API, puis rapporte les nombres de succès et d'échecs avec les requêtes en échec.
tools: Bash, Read
model: haiku
effort: low
---
Exécutez la commande de test CLI Apidog documentée dans le README de ce dépôt pour le
scénario qui couvre le point de terminaison modifié. Rapporter les nombres de succès et d'échecs.
Pour chaque échec, donnez le nom de la requête, le résultat attendu et le résultat réel.
Ne modifiez pas le code. Ne réessayez pas une exécution échouée plus d'une fois.
La configuration pour le CLI, y compris l'authentification et la commande d'exécution, se trouve dans Apidog CLI dans Claude Code. Téléchargez Apidog pour construire les scénarios que le sous-agent exécute.
Migrer une application de Haiku 4.5
Si votre application appelle Haiku 4.5 via l'API, Claude Code peut démarrer la migration :
/claude-api migrate this project to claude-haiku-5-5
Attendez-vous à des changements majeurs : la réflexion manuelle budget_tokens, une temperature ou top_p non par défaut, tout top_k, et le préremplissage de l'assistant renvoient tous une erreur 400 sur Haiku 5.5. Le guide Haiku 5.5 vs Haiku 4.5 liste chaque correction. Après la modification, enregistrez l'ancienne et la nouvelle requête comme une paire dans Apidog, stockez ANTHROPIC_API_KEY comme variable d'environnement, et affirmez sur stop_reason et usage, de sorte qu'un nouvel arrêt de refusal ou un saut dans les jetons échoue un test au lieu d'atteindre la production.
FAQ
Haiku 5.5 est-il le modèle par défaut dans Claude Code ? Non. C'est le modèle Haiku par défaut sur l'API Anthropic, ce qui signifie que l'alias haiku pointe vers lui. Sélectionnez-le comme modèle principal avec --model ou /model.
Puis-je utiliser Haiku 5.5 dans Claude Code avec le plan gratuit ? Non. Claude Code nécessite un plan payant ou une clé API. Les utilisateurs gratuits peuvent choisir Haiku 5.5 dans les applications Claude.ai ; voir comment utiliser Claude Haiku 5.5 gratuitement.
Pourquoi model: haiku me donne-t-il Haiku 4.5 ? Vous êtes sur Bedrock, Google Cloud, Foundry ou la plateforme Claude sur AWS, ou sur une version antérieure à v2.1.293. Épinglez l'ID complet ou définissez ANTHROPIC_DEFAULT_HAIKU_MODEL.
Puis-je désactiver la réflexion (thinking) pour économiser des jetons ? Pas dans Claude Code. Baissez plutôt l'effort ; low est le paramètre le plus économique.
Votre prochaine étape
Exécutez claude update, ajoutez la surcharge Haiku Explore, et gardez votre modèle principal actuel pendant une semaine. Ajoutez ensuite le sous-agent d'exécution de tests si votre projet possède des API. Pour appeler le modèle depuis votre propre code, commencez par le guide API de Haiku 5.5. Apidog est gratuit pour commencer et donne à ce sous-agent de vrais tests à exécuter.
