Claude Haiku 5.5 vs Haiku 4.5 : Nouveautés et ruptures à corriger en priorité

Haiku 5.5 vs Haiku 4.5 : 90 % moins cher jusqu'à 100 000 jetons, 1 million de contexte, et cinq changements majeurs qui renvoient des erreurs 400. Exemples de corrections JSON avant/après.

Medy Evrard

8 October 2026

Claude Haiku 5.5 vs Haiku 4.5 : Nouveautés et ruptures à corriger en priorité

Apidog pour les entreprises

Déploiement sur site

SSO & RBAC

Conforme SOC 2

Découvrir Apidog Enterprise

Claude Haiku 5.5 (claude-haiku-5-5, sorti le 7 octobre 2026) coûte 90 % moins cher que Haiku 4.5 pour les invites jusqu'à 100 000 jetons (0,10 $/0,50 $ par million de jetons d'entrée/sortie contre 1 $/5 $), dispose d'une fenêtre contextuelle d'un million de jetons au lieu de 200 000, et obtient des scores bien plus élevés sur tous les benchmarks de lancement qui les listent tous les deux. Le revers de la médaille : cinq formes de requêtes qui fonctionnaient sur 4.5 renvoient désormais une erreur 400, et plusieurs autres changements modifient les réponses et les coûts sans erreur.

Ci-dessous : un tableau comparatif, chaque changement majeur avec le JSON avant/après, les changements silencieux, et un plan de test pour Apidog. Pour la fiche technique complète, lisez qu'est-ce que Claude Haiku 5.5. Si vous utilisez toujours l'ancien modèle, notre guide de l'API Claude Haiku 4.5 le couvre.

bouton

Haiku 4.5 vs Haiku 5.5 en un coup d'œil

Claude Haiku 4.5 Claude Haiku 5.5
ID du modèle (API Claude) claude-haiku-4-5-20251001 claude-haiku-5-5
Contexte / sortie max 200K / 64K 1M / 128K
Entrée / sortie par MJetons 1 $ / 5 $ 0,10 $ / 0,50 $ pour les invites jusqu'à 100 000 jetons ; 0,50 $ / 2,50 $ au-delà
Lecture cache / écriture 5min par MJetons 0,10 $ / 1,25 $ 0,01 $ / 0,125 $ jusqu'à 100K ; 0,05 $ / 0,625 $ au-delà
Entrée / sortie par lot par MJetons 0,50 $ / 2,50 $ 0,05 $ / 0,25 $ jusqu'à 100K ; 0,25 $ / 1,25 $ au-delà
Réflexion budget_tokens manuel Adaptatif uniquement, activé par défaut
Niveaux d'effort Aucun faible, moyen (par défaut), élevé, très élevé, max
Invite minimale cachable 4 096 jetons 512 jetons
Tokeniseur Ancien Environ 30 % de jetons en plus pour le même texte
Paramètres d'échantillonnage non par défaut, préremplissage Accepté Erreur 400
Niveau de priorité Pris en charge Non pris en charge
Statut Actif, retrait pas avant le 15 oct. 2026 Actif, retrait pas avant le 7 oct. 2027

Haiku 4.5 n'est pas obsolète. La page d'obsolescence des modèles le liste comme Actif sans date d'obsolescence, vous pouvez donc migrer selon votre propre calendrier. Les limites de débit sont les mêmes pour les deux.

Les cinq changements majeurs

Chacun renvoie une erreur 400 sur Haiku 5.5 pour un corps de requête qui fonctionne sur 4.5. Le guide de migration Haiku 5.5 les liste tous.

1. Réflexion manuelle avec budget_tokens

Haiku 5.5 n'utilise que la réflexion adaptative. Un budget fixe est rejeté.

// Avant (Haiku 4.5)
{
  "model": "claude-haiku-4-5-20251001",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

// Après (Haiku 5.5)
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

L'effort est désormais le levier : là où 4.5 utilisait un petit budget, choisissez un effort plus faible. Vous pouvez toujours envoyer thinking: {"type": "disabled"}, mais seulement à un effort high ou inférieur ; à xhigh ou max, cela renvoie également une erreur 400.

2. Paramètres d'échantillonnage

Supprimez temperature, top_p et top_k. Les seules valeurs acceptées sont temperature: 1 et top_p: 0.99. Toute autre valeur renvoie une erreur 400, y compris top_p: 1, tout top_k, et l'envoi de temperature et top_p ensemble.

// Avant (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "temperature": 0.2, "top_k": 40,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

// Après (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

Si vous utilisiez une basse température pour une sortie cohérente, intégrez cette intention dans l'invite.

3. Préremplissage de l'assistant

Un tour d'assistant final pour que le modèle continue est rejeté, même si la réflexion est désactivée. Terminez messages par un tour d'utilisateur.

// Avant (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." },
    { "role": "assistant", "content": "{\"sentiment\": \"" }
  ] }

// Après (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "system": "Reply with only a JSON object. No preamble.",
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." }
  ] }

Pour les formats stricts, le guide de migration renvoie aux sorties structurées, ou à un outil avec des champs d'énumération pour la classification.

4. Utilisation de l'ordinateur : de computer_20250124 à computer_toolset_20260801

Sur l'API Claude et Google Cloud, Haiku 5.5 prend en charge l'utilisation de l'ordinateur uniquement via le nouvel ensemble d'outils. Supprimez l'en-tête bêta computer-use-2025-01-24, et supprimez fine-grained-tool-streaming-2025-05-14 si vous l'envoyez, car il renvoie une erreur 400 avec un ensemble d'outils.

// Avant (Haiku 4.5, en-tête anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
  "tools": [{ "type": "computer_20250124", "name": "computer",
              "display_width_px": 1280, "display_height_px": 800 }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

// Après (Haiku 5.5, pas d'en-tête bêta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "tools": [{ "type": "computer_toolset_20260801" }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

Votre boucle d'agent change aussi : dispatchez sur les name et toolset_name de chaque bloc tool_use au lieu de input.action, et faites écho de toolset_name sur les résultats. Haiku 5.5 obtient également l'outil d'utilisation du navigateur (browser_toolset_20260801), que Haiku 4.5 ne prend pas en charge. Voir l'utilisation de l'ordinateur avec Claude Code pour une vue d'ensemble.

5. Modification des tours précédents avant un bloc de réflexion

Un bloc de réflexion Haiku 5.5 reste valide tant que tout ce qui a été envoyé avant reste inchangé. Modifiez system, tools ou un message précédent et renvoyez le bloc, et vous obtiendrez une erreur 400. Haiku 4.5 n'a jamais effectué cette vérification. Ici, le tour 1 a envoyé "system": "You are a billing agent." et le tour 2 le modifie.

// Avant : système modifié + bloc de réflexion rejoué = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent. Be brief.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412." }
  ] }

// Après : tours précédents inchangés, nouvelle instruction ajoutée
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412. Be brief." }
  ] }

Sur les comptes créés avant le 31 août 2026, 00:00 UTC, l'erreur n'apparaît que sur les requêtes qui définissent thinking.block_binding.prefix_mismatch_behavior.

Changements silencieux qui ne provoqueront pas d'erreur

Ce qui s'est amélioré

Ce sont des chiffres rapportés par Anthropic avec Haiku 5.5 à effort maximal ; Artificial Analysis a exécuté GDPval-AA et AA-Briefcase indépendamment.

Benchmark Haiku 4.5 Haiku 5.5
GDPval-AA v2.1 (Elo) 735 1620
AA-Briefcase v1.1 (Elo) 614 1578
OSWorld 2.1, sous-ensemble hors ligne 15.7% 72.4%
Le dernier examen de l'humanité, avec outils 18.7% 57.4%
Terminal-Bench 4.0 0.0% 39.2%
SWE-bench Multilingue 67.4% 83.7%
Cartographie, sans outils 6.4% 46.4%

L'exécution de Terminal-Bench de Haiku 4.5 utilisait un budget de réflexion fixe de 63 999 jetons. Avec l'effort medium par défaut, Haiku 5.5 a obtenu un score de 1277 sur GDPval-AA, toujours bien au-dessus de 4.5. Box a rapporté des scores 11 points plus élevés que Haiku 4.5 pour environ la moitié de la latence. Les tableaux complets se trouvent dans les benchmarks de Claude Haiku 5.5.

Anthropic positionne toujours Sonnet 5.5 et Opus 5.5 comme de meilleurs choix pour le codage agentique complexe. Haiku 5.5 cible la classification, l'extraction, la summarisation, la compaction, les sous-agents et l'utilisation du navigateur.

En termes de coût, Anthropic affirme que Haiku 5.5 est en moyenne environ 75 % moins cher. Ce chiffre combine des prix 90 % inférieurs jusqu'à 100 000 jetons et 50 % inférieurs au-delà, et il neutralise déjà les jetons supplémentaires du nouveau tokeniseur. L'invite système d'utilisation des outils a également diminué, passant de 496 à 286 jetons avec le choix d'outil auto. Des exemples détaillés se trouvent dans la tarification de Claude Haiku 5.5.

Testez la migration dans Apidog

Dans Apidog, créez un projet avec trois requêtes enregistrées vers https://api.anthropic.com/v1/messages :

  1. Référence : votre corps de requête Haiku 4.5 actuel. Affirmez le statut 200.
  2. Ancien corps, nouveau modèle : ne changez que model en claude-haiku-5-5. Affirmez le statut 400. Gardez une copie par changement majeur rencontré.
  3. Migré : le corps corrigé. Affirmez le statut 200, une stop_reason qui n'est pas refusal ou max_tokens, et un bloc de texte trouvé par type.

Stockez ANTHROPIC_API_KEY comme variable d'environnement et référencez-la comme {{ANTHROPIC_API_KEY}} dans l'en-tête x-api-key, avec anthropic-version: 2023-06-01. Comparez usage.input_tokens entre la requête de référence et la requête migrée pour voir le changement du tokeniseur sur vos propres invites. Enregistrez l'ensemble comme scénario de test, et un coéquipier qui réintroduit temperature fera échouer l'exécution au lieu de la production. Les bases des requêtes se trouvent dans comment utiliser l'API Claude Haiku 5.5.

Si vous travaillez avec Claude Code, /claude-api migrate this project to claude-haiku-5-5 applique l'échange d'ID de modèle et les corrections de paramètres, puis vous donne une liste de contrôle. Notez que l'alias haiku se résout en Haiku 5.5 uniquement sur l'API Anthropic ; voir Claude Haiku 5.5 dans Claude Code.

FAQ

Claude Haiku 4.5 est-il obsolète ? Non. Il est listé comme Actif sans date d'obsolescence, et son retrait n'est pas avant le 15 octobre 2026.

Pourquoi ma requête Haiku 4.5 renvoie-t-elle une erreur 400 sur Haiku 5.5 ? Vérifiez la présence de budget_tokens, temperature/top_p/top_k, un préremplissage d'assistant, computer_20250124, ou des modifications des tours précédents avant un bloc de réflexion. Ce sont les cinq changements majeurs.

Haiku 5.5 est-il moins cher que Haiku 4.5 pour les longues invites ? Oui. Au-delà de 100 000 jetons, il coûte 0,50 $/2,50 $ par million, soit la moitié des 1 $/5 $ de Haiku 4.5. Haiku 4.5 ne peut pas du tout gérer les invites au-delà de 200 000.

Dois-je tout passer à Haiku 5.5 ? Pour les travaux de classification, d'extraction et de sous-agents, testez-le d'abord, puis passez à la migration. Comparez-le à son rival le plus proche dans Haiku 5.5 vs GPT-6 Luna.

Étape suivante

Enregistrez votre requête Haiku 4.5 à côté de son équivalent Haiku 5.5, confirmez l'erreur 400, corrigez-la, puis basculez le trafic une fois que la requête migrée passe. Téléchargez Apidog pour construire cette paire de tests.

Pratiquez le Design-first d'API dans Apidog

Découvrez une manière plus simple de créer et utiliser des API