Comment utiliser Claude Haiku 5.5 dans Claude Code (et comme modèle de sous-agent)

Claude Haiku 5.5 dans Claude Code: v2.1.293+, /model claude-haiku-5-5, le piège de l'alias haïku, modèle : sous-agents haïku, effort, et le palier de prix de 100K.

Ashley Innocent

Ashley Innocent

8 October 2026

Comment utiliser Claude Haiku 5.5 dans Claude Code (et comme modèle de sous-agent)

Apidog pour les entreprises

Déploiement sur site

SSO & RBAC

Conforme SOC 2

Découvrir Apidog Enterprise

Pour utiliser Claude Haiku 5.5 dans Claude Code, mettez à jour vers la version v2.1.293 ou ultérieure avec claude update, puis démarrez une session avec claude --model claude-haiku-5-5 ou exécutez /model claude-haiku-5-5 à l'intérieur d'une session. Le plus grand avantage pour la plupart des gens est de l'exécuter en tant que sous-agent : mettez model: haiku dans un fichier de sous-agent et laissez Sonnet 5.5 ou Opus 5.5 lui confier les recherches, les exécutions de tests et les résumés. Avec une clé API, cela coûte 0,10 $/0,50 $ par million de jetons d'entrée/sortie pour les prompts jusqu'à 100K jetons, et 0,50 $/2,50 $ au-delà.

Ci-dessous : configuration, le piège de l'alias haiku, l'effort, les fichiers de sous-agent, le palier de prix de 100K, et quand Sonnet ou Opus devrait être le modèle principal. Pour le modèle lui-même, lisez ce qu'est Claude Haiku 5.5. Si votre code appelle des API, Apidog contient les scénarios de test qu'un sous-agent Haiku peut exécuter pour vous.

Claude Haiku 5.5 dans Claude Code en un coup d'œil

Paramètre Haiku 5.5
Version minimale v2.1.293 (claude update)
ID du modèle claude-haiku-5-5
Alias haiku Haiku 5.5 sur l'API Anthropic uniquement
Contexte 1M natif sur chaque plan, pas de suffixe [1m]
Auto-compaction Environ 967K jetons par défaut
Effort par défaut medium (niveaux de low à max)
Réflexion (Thinking) Toujours activée ; ne peut pas être désactivée
Prix API 0,10 $/0,50 $ pour les prompts jusqu'à 100K jetons ; 0,50 $/2,50 $ au-delà de 100K
Plans Pro, Max, Team, Enterprise ou une clé API ; pas Gratuit

Étape 1 : mettre à jour Claude Code

Haiku 5.5 nécessite Claude Code v2.1.293 ou ultérieure. L'entrée du journal des modifications l'appelle « désormais le modèle Haiku par défaut sur l'API Anthropic ».

claude update

Claude Code n'est pas disponible sur le plan gratuit. Les utilisateurs gratuits peuvent sélectionner Haiku 5.5 dans les applications Claude.ai, mais Claude Code nécessite un plan Pro, Max, Team, Enterprise ou une clé API Anthropic. Selon claude.com/pricing, le plan Pro coûte 17 $ par mois facturé annuellement ou 20 $ par mois, et le plan Max commence à 100 $.

Étape 2 : sélectionner Haiku 5.5 comme modèle principal

claude --model claude-haiku-5-5

À l'intérieur d'une session en cours, /model claude-haiku-5-5 fait la même chose. Si votre paramètre model enregistré est haiku, une session enregistrée sur Haiku 4.5 reprendra sur Haiku 5.5.

L'alias haiku ne signifie Haiku 5.5 que sur l'API Anthropic

Fournisseur haiku correspond à
API Anthropic Haiku 5.5
Plateforme Claude sur AWS Haiku 4.5
Amazon Bedrock, Agent Platform de Google Cloud Haiku 4.5
Microsoft Foundry Haiku 4.5

Sur tout fournisseur cloud, /model haiku et model: haiku dans un fichier de sous-agent vous donnent Haiku 4.5. Épinglez plutôt l'ID complet : claude-haiku-5-5 sur Google Cloud et la plateforme Claude sur AWS, le nom de votre déploiement sur Foundry, et un ID de profil d'inférence tel que us.anthropic.claude-haiku-5-5 sur Amazon Bedrock. Ou pointez l'alias vers celui-ci avec ANTHROPIC_DEFAULT_HAIKU_MODEL (Étape 5).

Étape 3 : choisir un niveau d'effort

Haiku 5.5 est le premier Haiku avec contrôle de l'effort : low, medium, high, xhigh et max, commençant à medium dans Claude Code.

claude --model claude-haiku-5-5 --effort high

Dans une session, /effort low enregistre un niveau pour le modèle actuel. Le guide de prompting d'Anthropic suggère low pour les tâches d'outil courtes et les requêtes à volume élevé, medium pour la plupart des travaux, et high pour les tâches d'agent plus longues. Réservez xhigh et max pour les tâches où vos évaluations montrent un gain.

La réflexion (Thinking) reste activée. Vous ne pouvez pas la désactiver sur Haiku 5.5 dans Claude Code ; alwaysThinkingEnabled: false et MAX_THINKING_TOKENS=0 n'ont aucun effet. (L'API Messages brute peut la désactiver à high ou moins.) Diminuez l'effort lorsque vous souhaitez moins de jetons de réflexion.

Étape 4 : exécuter Haiku 5.5 en tant que sous-agent

Anthropic affirme que Haiku 5.5 « se marie bien avec Opus 5.5 et Sonnet 5.5 en tant que sous-agent pour les tâches de codage ». Les sous-agents sont des fichiers Markdown avec des métadonnées YAML dans .claude/agents/ (projet) ou ~/.claude/agents/ (tous les projets). Seuls name et description sont requis, et la documentation des sous-agents accepte sonnet, opus, haiku, fable, un ID de modèle complet ou inherit pour model. Notre guide des sous-agents couvre les scopes et les outils.

Remplacer Explore par un explorateur économique

Le sous-agent Explore intégré s'exécute sur le modèle de la conversation principale, et non sur Haiku. Dans une session Opus 5.5, chaque recherche Explore s'exécute sur Opus. Un sous-agent utilisateur ou projet nommé Explore remplace l'agent intégré et conserve son propre model :

---
name: Explore
description: Recherche rapide en lecture seule dans la base de code. Permet de trouver des fichiers, des symboles et des sites d'appel sans rien modifier.
tools: Read, Grep, Glob
model: haiku
effort: low
---

Vous recherchez dans la base de code et rapportez ce que vous trouvez. Retournez les chemins de fichiers avec les numéros de ligne et un court résumé de chaque correspondance. Ne modifiez jamais les fichiers.

Enregistrez-le sous .claude/agents/Explore.md. Exécutez /tasks pendant qu'il fonctionne pour confirmer le modèle. Sur un fournisseur cloud, remplacez haiku par l'ID complet de l'étape 2.

Forcer chaque sous-agent à utiliser Haiku

Pour exécuter chaque sous-agent sur Haiku, y compris Explore, définissez les deux variables dans le bloc env d'un fichier de paramètres :

{
  "env": {
    "CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
    "CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
  }
}

CLAUDE_CODE_SUBAGENT_MODEL seul est une valeur par défaut : le champ model propre à un sous-agent l'emporte toujours, et Explore ne change pas.

Étape 5 : diriger les tâches de fond vers Haiku 5.5

ANTHROPIC_DEFAULT_HAIKU_MODEL définit « le modèle à utiliser pour haiku, ou les fonctionnalités en arrière-plan », comme la synthèse des sessions passées pour claude --resume. L'ancien ANTHROPIC_SMALL_FAST_MODEL est obsolète, selon la référence des variables d'environnement ; remplacez-le si votre profil shell le définit toujours.

Sur l'API Anthropic, vous n'avez rien à définir. Sur Google Cloud, les tâches de fond par défaut sont Sonnet ; sur Foundry, le modèle principal ; sur Bedrock, Sonnet ou le modèle principal. Une fois que Haiku 5.5 est activé dans votre compte, épinglez-le :

# Plateforme d'agents de Google Cloud
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5

# Amazon Bedrock (ID de profil d'inférence)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5

Le palier de prix de 100K dans les sessions longues

Le prix de Haiku 5.5 dépend de la longueur du prompt, et Claude Code envoie la conversation comme prompt à chaque tour. Une fois que le contexte d'une session dépasse 100K jetons, chaque requête est facturée à 0,50 $/2,50 $ au lieu de 0,10 $/0,50 $, soit cinq fois le tarif des prompts courts. La documentation ne précise pas si les jetons mis en cache comptent pour cette ligne, alors prévoyez comme s'ils le faisaient.

L'auto-compaction ne vous sauvera pas : Haiku 5.5 se compacte à environ 967K jetons par défaut, donc une session peut dépasser largement le palier de prix avant. Deux habitudes aident lorsque vous payez par jeton :

  1. Compacter plus tôt. /autocompact 100k définit la fenêtre la plus basse acceptée par Claude Code, de sorte que la session se compacte près de la limite au lieu de près de 1M.
  2. Pousser le travail volumineux dans les sous-agents. Un sous-agent a son propre contexte, de sorte que les journaux de test et les résultats de recherche restent en dehors de la conversation principale.

Même au-delà de 100K, 0,50 $/2,50 $ est un quart des 2 $/10 $ de Sonnet 5.5. Sur un plan payant, les sessions utilisent plutôt les limites d'utilisation, et Anthropic n'a pas publié comment Haiku 5.5 est comptabilisé par rapport à celles-ci. Notre répartition des prix de Haiku 5.5 explique l'arithmétique.

Abonnés Max et Team : les nouveaux crédits API mensuels (100 $ sur Max 5x, 200 $ sur Max 20x, jusqu'à 500 $ mutualisés sur Team) ne couvrent pas Claude Code interactif, selon la documentation des crédits API d'Anthropic.

Quand garder Sonnet 5.5 ou Opus 5.5 comme modèle principal

Anthropic affirme que Sonnet 5.5 et Opus 5.5 « restent de meilleurs choix pour les tâches de codage agentique complexes ». Sur Terminal-Bench 4.0, exécuté par Anthropic dans Claude Code à effort maximal, Haiku 5.5 a obtenu un score de 39,2 % contre 70,6 % pour Sonnet 5.5. Les graphiques de lancement ajoutent le coût par tentative :

Effort Haiku 5.5 Sonnet 5.5
medium 20,3 % à 0,68 $ 28,8 % à 0,68 $
high 24,8 % à 1,04 $ 43 % à 1,46 $
max 39,2 % à 2,64 $ 70,6 % à 10,44 $

À medium, les deux coûtent à peu près le même prix par tentative et Sonnet obtient un score plus élevé. Le prix des jetons de Haiku ne se répercute pas sur les longues sessions de codage, alors ne le mettez pas en tête pour les sessions de codage difficiles.

L'utilisation de l'ordinateur raconte une histoire différente. Sur OSWorld 2.1, Haiku 5.5 à medium a obtenu un score de 53,3 % à 0,13 $ par tentative, tandis que Sonnet 5.5 à low a obtenu un score de 57,9 % à 0,68 $. Notre analyse des benchmarks de Haiku 5.5 contient chaque ligne, et le guide Claude Code de Sonnet 5.5 couvre l'aspect modèle principal.

Une répartition pratique : Sonnet 5.5 ou Opus 5.5 comme modèle principal, Haiku 5.5 pour Explore, les exécuteurs de tests, les lecteurs de journaux et les récupérateurs de documentation.

Exemple : un sous-agent Haiku qui exécute vos tests Apidog

Les exécutions de tests sont verbeuses et répétitives, un bon usage pour Haiku. Le CLI Apidog exécute vos scénarios de test Apidog enregistrés depuis le terminal, de sorte qu'un sous-agent peut les exécuter et renvoyer un rapport court tandis que le contexte du modèle principal reste propre.

---
name: api-test-runner
description: Exécute les scénarios de test Apidog du projet avec le CLI Apidog après la modification d'un point de terminaison API, puis rapporte les nombres de succès et d'échecs avec les requêtes en échec.
tools: Bash, Read
model: haiku
effort: low
---

Exécutez la commande de test CLI Apidog documentée dans le README de ce dépôt pour le
scénario qui couvre le point de terminaison modifié. Rapporter les nombres de succès et d'échecs.
Pour chaque échec, donnez le nom de la requête, le résultat attendu et le résultat réel.
Ne modifiez pas le code. Ne réessayez pas une exécution échouée plus d'une fois.

La configuration pour le CLI, y compris l'authentification et la commande d'exécution, se trouve dans Apidog CLI dans Claude Code. Téléchargez Apidog pour construire les scénarios que le sous-agent exécute.

Migrer une application de Haiku 4.5

Si votre application appelle Haiku 4.5 via l'API, Claude Code peut démarrer la migration :

/claude-api migrate this project to claude-haiku-5-5

Attendez-vous à des changements majeurs : la réflexion manuelle budget_tokens, une temperature ou top_p non par défaut, tout top_k, et le préremplissage de l'assistant renvoient tous une erreur 400 sur Haiku 5.5. Le guide Haiku 5.5 vs Haiku 4.5 liste chaque correction. Après la modification, enregistrez l'ancienne et la nouvelle requête comme une paire dans Apidog, stockez ANTHROPIC_API_KEY comme variable d'environnement, et affirmez sur stop_reason et usage, de sorte qu'un nouvel arrêt de refusal ou un saut dans les jetons échoue un test au lieu d'atteindre la production.

FAQ

Haiku 5.5 est-il le modèle par défaut dans Claude Code ? Non. C'est le modèle Haiku par défaut sur l'API Anthropic, ce qui signifie que l'alias haiku pointe vers lui. Sélectionnez-le comme modèle principal avec --model ou /model.

Puis-je utiliser Haiku 5.5 dans Claude Code avec le plan gratuit ? Non. Claude Code nécessite un plan payant ou une clé API. Les utilisateurs gratuits peuvent choisir Haiku 5.5 dans les applications Claude.ai ; voir comment utiliser Claude Haiku 5.5 gratuitement.

Pourquoi model: haiku me donne-t-il Haiku 4.5 ? Vous êtes sur Bedrock, Google Cloud, Foundry ou la plateforme Claude sur AWS, ou sur une version antérieure à v2.1.293. Épinglez l'ID complet ou définissez ANTHROPIC_DEFAULT_HAIKU_MODEL.

Puis-je désactiver la réflexion (thinking) pour économiser des jetons ? Pas dans Claude Code. Baissez plutôt l'effort ; low est le paramètre le plus économique.

Votre prochaine étape

Exécutez claude update, ajoutez la surcharge Haiku Explore, et gardez votre modèle principal actuel pendant une semaine. Ajoutez ensuite le sous-agent d'exécution de tests si votre projet possède des API. Pour appeler le modèle depuis votre propre code, commencez par le guide API de Haiku 5.5. Apidog est gratuit pour commencer et donne à ce sous-agent de vrais tests à exécuter.

bouton

Pratiquez le Design-first d'API dans Apidog

Découvrez une manière plus simple de créer et utiliser des API