Claude Haiku 5.5 (claude-haiku-5-5, sorti le 7 octobre 2026) coûte 90 % moins cher que Haiku 4.5 pour les invites jusqu'à 100 000 jetons (0,10 $/0,50 $ par million de jetons d'entrée/sortie contre 1 $/5 $), dispose d'une fenêtre contextuelle d'un million de jetons au lieu de 200 000, et obtient des scores bien plus élevés sur tous les benchmarks de lancement qui les listent tous les deux. Le revers de la médaille : cinq formes de requêtes qui fonctionnaient sur 4.5 renvoient désormais une erreur 400, et plusieurs autres changements modifient les réponses et les coûts sans erreur.
Ci-dessous : un tableau comparatif, chaque changement majeur avec le JSON avant/après, les changements silencieux, et un plan de test pour Apidog. Pour la fiche technique complète, lisez qu'est-ce que Claude Haiku 5.5. Si vous utilisez toujours l'ancien modèle, notre guide de l'API Claude Haiku 4.5 le couvre.
Haiku 4.5 vs Haiku 5.5 en un coup d'œil
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| ID du modèle (API Claude) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| Contexte / sortie max | 200K / 64K | 1M / 128K |
| Entrée / sortie par MJetons | 1 $ / 5 $ | 0,10 $ / 0,50 $ pour les invites jusqu'à 100 000 jetons ; 0,50 $ / 2,50 $ au-delà |
| Lecture cache / écriture 5min par MJetons | 0,10 $ / 1,25 $ | 0,01 $ / 0,125 $ jusqu'à 100K ; 0,05 $ / 0,625 $ au-delà |
| Entrée / sortie par lot par MJetons | 0,50 $ / 2,50 $ | 0,05 $ / 0,25 $ jusqu'à 100K ; 0,25 $ / 1,25 $ au-delà |
| Réflexion | budget_tokens manuel |
Adaptatif uniquement, activé par défaut |
| Niveaux d'effort | Aucun | faible, moyen (par défaut), élevé, très élevé, max |
| Invite minimale cachable | 4 096 jetons | 512 jetons |
| Tokeniseur | Ancien | Environ 30 % de jetons en plus pour le même texte |
| Paramètres d'échantillonnage non par défaut, préremplissage | Accepté | Erreur 400 |
| Niveau de priorité | Pris en charge | Non pris en charge |
| Statut | Actif, retrait pas avant le 15 oct. 2026 | Actif, retrait pas avant le 7 oct. 2027 |
Haiku 4.5 n'est pas obsolète. La page d'obsolescence des modèles le liste comme Actif sans date d'obsolescence, vous pouvez donc migrer selon votre propre calendrier. Les limites de débit sont les mêmes pour les deux.
Les cinq changements majeurs
Chacun renvoie une erreur 400 sur Haiku 5.5 pour un corps de requête qui fonctionne sur 4.5. Le guide de migration Haiku 5.5 les liste tous.
1. Réflexion manuelle avec budget_tokens
Haiku 5.5 n'utilise que la réflexion adaptative. Un budget fixe est rejeté.
// Avant (Haiku 4.5)
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
// Après (Haiku 5.5)
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
L'effort est désormais le levier : là où 4.5 utilisait un petit budget, choisissez un effort plus faible. Vous pouvez toujours envoyer thinking: {"type": "disabled"}, mais seulement à un effort high ou inférieur ; à xhigh ou max, cela renvoie également une erreur 400.
2. Paramètres d'échantillonnage
Supprimez temperature, top_p et top_k. Les seules valeurs acceptées sont temperature: 1 et top_p: 0.99. Toute autre valeur renvoie une erreur 400, y compris top_p: 1, tout top_k, et l'envoi de temperature et top_p ensemble.
// Avant (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"temperature": 0.2, "top_k": 40,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
// Après (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
Si vous utilisiez une basse température pour une sortie cohérente, intégrez cette intention dans l'invite.
3. Préremplissage de l'assistant
Un tour d'assistant final pour que le modèle continue est rejeté, même si la réflexion est désactivée. Terminez messages par un tour d'utilisateur.
// Avant (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
] }
// Après (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"system": "Reply with only a JSON object. No preamble.",
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." }
] }
Pour les formats stricts, le guide de migration renvoie aux sorties structurées, ou à un outil avec des champs d'énumération pour la classification.
4. Utilisation de l'ordinateur : de computer_20250124 à computer_toolset_20260801
Sur l'API Claude et Google Cloud, Haiku 5.5 prend en charge l'utilisation de l'ordinateur uniquement via le nouvel ensemble d'outils. Supprimez l'en-tête bêta computer-use-2025-01-24, et supprimez fine-grained-tool-streaming-2025-05-14 si vous l'envoyez, car il renvoie une erreur 400 avec un ensemble d'outils.
// Avant (Haiku 4.5, en-tête anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
"tools": [{ "type": "computer_20250124", "name": "computer",
"display_width_px": 1280, "display_height_px": 800 }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
// Après (Haiku 5.5, pas d'en-tête bêta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"tools": [{ "type": "computer_toolset_20260801" }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
Votre boucle d'agent change aussi : dispatchez sur les name et toolset_name de chaque bloc tool_use au lieu de input.action, et faites écho de toolset_name sur les résultats. Haiku 5.5 obtient également l'outil d'utilisation du navigateur (browser_toolset_20260801), que Haiku 4.5 ne prend pas en charge. Voir l'utilisation de l'ordinateur avec Claude Code pour une vue d'ensemble.
5. Modification des tours précédents avant un bloc de réflexion
Un bloc de réflexion Haiku 5.5 reste valide tant que tout ce qui a été envoyé avant reste inchangé. Modifiez system, tools ou un message précédent et renvoyez le bloc, et vous obtiendrez une erreur 400. Haiku 4.5 n'a jamais effectué cette vérification. Ici, le tour 1 a envoyé "system": "You are a billing agent." et le tour 2 le modifie.
// Avant : système modifié + bloc de réflexion rejoué = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent. Be brief.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412." }
] }
// Après : tours précédents inchangés, nouvelle instruction ajoutée
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412. Be brief." }
] }
Sur les comptes créés avant le 31 août 2026, 00:00 UTC, l'erreur n'apparaît que sur les requêtes qui définissent thinking.block_binding.prefix_mismatch_behavior.
Changements silencieux qui ne provoqueront pas d'erreur
- Champ de réflexion vide par défaut. Chaque bloc de réflexion revient avec un champ
thinkingvide et seulement unesignature. Haiku 4.5 renvoyait une réflexion résumée. Définissezthinking: {"type": "adaptive", "display": "summarized"}si vous l'enregistrez ou l'affichez. - Les réponses peuvent commencer par une réflexion. La réflexion adaptative est activée même si vous ne la définissez pas, alors sélectionnez les blocs de contenu par
type, et non par index. - Environ 30 % de jetons en plus. Le nouveau tokeniseur compte le même texte comme environ 30 % de jetons en plus. Recomptez les invites, et rappelez-vous que les jetons de réflexion sont comptés dans
max_tokens, donc une petite limite peut s'arrêter avecstop_reason: "max_tokens"avant tout texte. - Le
tool_choiceforcé ignore la réflexion.anyou un outil nommé fonctionne toujours, mais la réponse commence par l'appel de l'outil et aucun bloc dethinking. Utiliseztool_choice: {"type": "auto"}et dites au modèle quand appeler l'outil si vous voulez qu'il raisonne d'abord. - Nouveaux refus, pas de repli. Haiku 5.5 exécute des classificateurs de sécurité (
cyber,frontier_llm,bio,general_harms) qui peuvent renvoyerstop_reason: "refusal". Il n'y a pas de repli côté serveur, et une nouvelle tentative refuse généralement de nouveau. - Le niveau de priorité a disparu. Si vous avez un engagement de niveau de priorité sur Haiku 4.5, planifiez la capacité séparément.
- Les blocs de réflexion sont liés au compte. Ils ne fonctionnent que dans le compte qui les a produits ou un compte lié. Rejouer des conversations stockées via un autre compte fait perdre ce raisonnement.
- La mise en cache moins chère commence plus tôt. L'invite minimale cachable passe de 4 096 à 512 jetons, de sorte que les invites système courtes qui n'étaient jamais mises en cache sur 4.5 le sont désormais.
Ce qui s'est amélioré
Ce sont des chiffres rapportés par Anthropic avec Haiku 5.5 à effort maximal ; Artificial Analysis a exécuté GDPval-AA et AA-Briefcase indépendamment.
| Benchmark | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, sous-ensemble hors ligne | 15.7% | 72.4% |
| Le dernier examen de l'humanité, avec outils | 18.7% | 57.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| SWE-bench Multilingue | 67.4% | 83.7% |
| Cartographie, sans outils | 6.4% | 46.4% |
L'exécution de Terminal-Bench de Haiku 4.5 utilisait un budget de réflexion fixe de 63 999 jetons. Avec l'effort medium par défaut, Haiku 5.5 a obtenu un score de 1277 sur GDPval-AA, toujours bien au-dessus de 4.5. Box a rapporté des scores 11 points plus élevés que Haiku 4.5 pour environ la moitié de la latence. Les tableaux complets se trouvent dans les benchmarks de Claude Haiku 5.5.
Anthropic positionne toujours Sonnet 5.5 et Opus 5.5 comme de meilleurs choix pour le codage agentique complexe. Haiku 5.5 cible la classification, l'extraction, la summarisation, la compaction, les sous-agents et l'utilisation du navigateur.
En termes de coût, Anthropic affirme que Haiku 5.5 est en moyenne environ 75 % moins cher. Ce chiffre combine des prix 90 % inférieurs jusqu'à 100 000 jetons et 50 % inférieurs au-delà, et il neutralise déjà les jetons supplémentaires du nouveau tokeniseur. L'invite système d'utilisation des outils a également diminué, passant de 496 à 286 jetons avec le choix d'outil auto. Des exemples détaillés se trouvent dans la tarification de Claude Haiku 5.5.
Testez la migration dans Apidog
Dans Apidog, créez un projet avec trois requêtes enregistrées vers https://api.anthropic.com/v1/messages :

- Référence : votre corps de requête Haiku 4.5 actuel. Affirmez le statut 200.
- Ancien corps, nouveau modèle : ne changez que
modelenclaude-haiku-5-5. Affirmez le statut 400. Gardez une copie par changement majeur rencontré. - Migré : le corps corrigé. Affirmez le statut 200, une
stop_reasonqui n'est pasrefusaloumax_tokens, et un bloc de texte trouvé partype.
Stockez ANTHROPIC_API_KEY comme variable d'environnement et référencez-la comme {{ANTHROPIC_API_KEY}} dans l'en-tête x-api-key, avec anthropic-version: 2023-06-01. Comparez usage.input_tokens entre la requête de référence et la requête migrée pour voir le changement du tokeniseur sur vos propres invites. Enregistrez l'ensemble comme scénario de test, et un coéquipier qui réintroduit temperature fera échouer l'exécution au lieu de la production. Les bases des requêtes se trouvent dans comment utiliser l'API Claude Haiku 5.5.
Si vous travaillez avec Claude Code, /claude-api migrate this project to claude-haiku-5-5 applique l'échange d'ID de modèle et les corrections de paramètres, puis vous donne une liste de contrôle. Notez que l'alias haiku se résout en Haiku 5.5 uniquement sur l'API Anthropic ; voir Claude Haiku 5.5 dans Claude Code.
FAQ
Claude Haiku 4.5 est-il obsolète ? Non. Il est listé comme Actif sans date d'obsolescence, et son retrait n'est pas avant le 15 octobre 2026.
Pourquoi ma requête Haiku 4.5 renvoie-t-elle une erreur 400 sur Haiku 5.5 ? Vérifiez la présence de budget_tokens, temperature/top_p/top_k, un préremplissage d'assistant, computer_20250124, ou des modifications des tours précédents avant un bloc de réflexion. Ce sont les cinq changements majeurs.
Haiku 5.5 est-il moins cher que Haiku 4.5 pour les longues invites ? Oui. Au-delà de 100 000 jetons, il coûte 0,50 $/2,50 $ par million, soit la moitié des 1 $/5 $ de Haiku 4.5. Haiku 4.5 ne peut pas du tout gérer les invites au-delà de 200 000.
Dois-je tout passer à Haiku 5.5 ? Pour les travaux de classification, d'extraction et de sous-agents, testez-le d'abord, puis passez à la migration. Comparez-le à son rival le plus proche dans Haiku 5.5 vs GPT-6 Luna.
Étape suivante
Enregistrez votre requête Haiku 4.5 à côté de son équivalent Haiku 5.5, confirmez l'erreur 400, corrigez-la, puis basculez le trafic une fois que la requête migrée passe. Téléchargez Apidog pour construire cette paire de tests.
