Claude Haiku 5.5 est le modèle actuel le plus petit et le plus rapide d'Anthropic, lancé le 7 octobre 2026, avec l'ID d'API claude-haiku-5-5. Il coûte 0,10 $ par million de jetons d'entrée et 0,50 $ par million de jetons de sortie pour les invites jusqu'à 100 000 jetons, et 0,50 $/2,50 $ pour les invites de plus de 100 000 jetons. Dans son article de lancement, Anthropic déclare qu'il coûte "environ 75 % moins cher à exécuter" que Haiku 4.5 en moyenne, et le qualifie de "notre modèle le plus rapide à ce jour". C'est aussi le premier Haiku avec un paramètre d'effort, et il offre une fenêtre contextuelle de 1 million de jetons.
Ci-dessous : les spécifications, le prix à deux niveaux, les changements par rapport à Haiku 4.5, les benchmarks, où l'exécuter et qui devrait l'adopter, avec des liens vers des guides plus approfondis comme la répartition des prix de Haiku 5.5. Pour appeler le modèle pendant votre lecture, Apidog peut envoyer la requête Messages, conserver votre clé dans une variable d'environnement et afficher la réponse à côté de son utilisation de jetons.
Spécifications de Claude Haiku 5.5 en un coup d'œil
| Spécification | Claude Haiku 5.5 |
|---|---|
| Date de sortie | 7 octobre 2026 |
| ID du modèle (API Claude, Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS) | claude-haiku-5-5 (ID fixe, pas de suffixe de date) |
| ID du modèle (Amazon Bedrock) | anthropic.claude-haiku-5-5 |
| Fenêtre contextuelle | 1 million de jetons (Haiku 4.5 : 200 000) |
| Sortie maximale | 128 000 (Haiku 4.5 : 64 000) ; 300 000 sur l'API Batch avec l'en-tête bêta output-300k-2026-03-24 |
| Réflexion | Adaptative uniquement |
| Niveaux d'effort | low (faible), medium (moyen, par défaut), high (élevé), xhigh (très élevé), max (maximum) |
| Date limite de connaissance | Juin 2026 |
| Prix par MJetons, invites jusqu'à 100 000 jetons | 0,10 $ en entrée, 0,50 $ en sortie |
| Prix par MJetons, invites de plus de 100 000 jetons | 0,50 $ en entrée, 2,50 $ en sortie |
| Retrait | Pas avant le 7 octobre 2027 |
Place de Haiku 5.5 dans la gamme Claude
| Modèle | Entrée / sortie par MJetons | Effort par défaut | Latence |
|---|---|---|---|
| Claude Fable 5.1 | 10 $ / 50 $ | élevé | Plus lent |
| Claude Opus 5.5 | 4 $ / 20 $ | moyen | Modérée |
| Claude Sonnet 5.5 | 2 $ / 10 $ | élevé | Rapide |
| Claude Haiku 5.5 | 0,10 $ / 0,50 $ pour les invites jusqu'à 100 000 jetons | moyen | Le plus rapide |
Les quatre partagent une fenêtre contextuelle de 1M, une sortie maximale de 128K et une date limite de connaissance de juin 2026. Anthropic a conçu Haiku 5.5 "pour les tâches à fort volume et sensibles à la latence telles que la classification, l'extraction et le routage", ainsi que les résumés, le support en direct, l'utilisation du navigateur et le travail de sous-agent sous Opus 5.5 ou Sonnet 5.5.
L'affirmation de vitesse a une note de bas de page : le plus rapide "à la vitesse standard de chaque modèle", mais plus lent qu'Opus en mode Rapide. Anthropic ne publie pas de chiffre de jetons par seconde.
Tarification de Claude Haiku 5.5
Le prix dépend de la longueur de l'invite. Une invite de plus de 100 000 jetons paie le tarif le plus élevé.

Source : Tarification de l'API Claude.
Le chiffre "environ 75 % moins cher" est une moyenne : 90 % moins cher que Haiku 4.5 pour les invites jusqu'à 100 000 jetons, 50 % moins cher au-delà, 90 % des requêtes Haiku 4.5 étant en dessous du seuil. Il prend déjà en compte le nouveau tokenizer, qui produit environ 30 % de jetons en plus pour le même texte.
L'inférence US uniquement (inference_geo) coûte 1,1 fois plus cher sur chaque catégorie de jetons. L'invite minimale cacheable tombe à 512 jetons, contre 4 096 sur Haiku 4.5.
En dessous de 100 000 jetons, le prix catalogue correspond exactement à GPT-6 Luna (0,10 $ en entrée, 0,50 $ en sortie, 0,01 $ en lecture de cache, 0,125 $ en écriture de cache). Les seuils diffèrent : le supplément de Luna commence au-delà de 272 000 jetons d'entrée. La comparaison Haiku 5.5 vs GPT-6 Luna explore cet écart, et le guide de tarification contient des exemples de coûts calculés.
Ce qui a changé par rapport à Haiku 4.5
La fenêtre contextuelle est multipliée par cinq, la sortie maximale double, et vous obtenez un contrôle d'effort pour la première fois. Le guide de migration avertit que le code écrit pour Haiku 4.5 peut ne plus fonctionner. Cinq changements entraînent une erreur 400 :
- Budgets de réflexion manuels.
thinking: {"type": "enabled", "budget_tokens": N}échoue. Utilisez{"type": "adaptive"}avecoutput_config.effort. - Paramètres d'échantillonnage. Supprimez
temperature,top_pettop_k. Les valeurs non par défaut detemperatureoutop_péchouent, tout comme touttop_kou l'envoi simultané detemperatureettop_p. - Préremplissage de l'assistant. Rejeté, même avec la réflexion désactivée.
- Ancien outil d'utilisation d'ordinateur. Sur l'API Claude et Google Cloud, utilisez
computer_toolset_20260801;computer_20250124échoue. - Historique modifié. La modification de
system,toolsou des messages précédents avant un bloc de réflexion renvoyé échoue. Gardez les conversations en mode ajout uniquement.
D'autres changements n'entraîneront pas d'erreur mais modifieront vos résultats :
- Affichage de la réflexion. Les blocs de réflexion sont renvoyés vides par défaut, avec seulement une signature. Définissez
"display": "summarized"pour les lire. - Nombre de jetons. Environ 30 % de jetons en plus pour le même texte ;
max_tokenscouvre également la réflexion. - Utilisation forcée d'outils.
tool_choicedeanyou d'un outil nommé fonctionne toujours, mais la réponse n'a pas de bloc de réflexion. - Refus. Les classificateurs de sécurité peuvent renvoyer
stop_reason: "refusal", sans solution de repli côté serveur. - Niveau de priorité. Non pris en charge sur Haiku 5.5.
La réflexion peut être désactivée sur l'API à un effort high ou inférieur ; à xhigh et max, cela renvoie une erreur 400. Haiku 4.5 n'est pas déprécié : il est toujours listé comme actif. Le guide Haiku 5.5 vs Haiku 4.5 contient des JSON avant/après pour chaque correction.
Benchmarks de Claude Haiku 5.5
Les scores de Haiku 5.5 sont à effort maximal, pour la plupart moyennés sur cinq essais. Artificial Analysis a exécuté GDPval-AA et AA-Briefcase, Cognition a exécuté FrontierCode, et Anthropic a noté Chartography (un benchmark de Surge AI) avec sa propre implémentation.

Lisez attentivement trois cellules. FrontierCode met Haiku au maximum contre Sonnet 5.5 à xhigh ; au maximum, Sonnet a obtenu 46,2 %, en dessous des 46,4 % de Haiku. Anthropic a exécuté le score OSWorld de Luna via l'API d'OpenAI, tandis que le score Terminal-Bench de Luna provient du classement public (Codex CLI). Et à l'effort medium par défaut, Haiku 5.5 a obtenu 1277 sur GDPval-AA et 1372 sur AA-Briefcase.
Anthropic affirme que Sonnet 5.5 et Opus 5.5 "restent de meilleurs choix pour les tâches de codage agentiques complexes". Aucun classement indépendant n'avait de résultat Haiku 5.5 au 8 octobre 2026 ; Cursor rapporte 48,4 % sur son propre CursorBench au maximum. L'analyse approfondie des benchmarks contient les scores et les coûts par niveau d'effort.
Où vous pouvez utiliser Claude Haiku 5.5
| Surface | Accès | Remarques |
|---|---|---|
| API Claude | claude-haiku-5-5 |
Paiement par jeton |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
Facturé via AWS Marketplace |
| Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS | claude-haiku-5-5 |
Même ID que l'API Claude |
| Claude.ai (web, iOS, Android) | Sélecteur de modèle | Les utilisateurs Free, Pro, Max, Team et Enterprise peuvent le sélectionner |
| Claude Code | /model claude-haiku-5-5 |
v2.1.293 ou ultérieure ; forfaits payants |
| Vercel AI Gateway | anthropic/claude-haiku-5.5 |
À partir de 0,10 $ / 0,50 $ |
| Cursor | claude-haiku-5-5 |
Pool Autres Modèles |
Au 8 octobre 2026, il n'était pas disponible sur OpenRouter ni annoncé pour GitHub Copilot.
L'accès au chat sur le forfait Gratuit n'est pas une clé API, et l'API est payante à l'utilisation au-delà du petit crédit gratuit qu'Anthropic offre aux nouveaux utilisateurs pour les tests. Les forfaits Max et Team incluent désormais des crédits API mensuels (100 $ sur Max 5x, 200 $ sur Max 20x, jusqu'à 500 $ mutualisés sur Team), qui ne couvrent pas Claude Code. Le guide d'accès gratuit liste ce qui est gratuit et ce qui ne l'est pas.
Dans Claude Code, l'alias haiku signifie Haiku 5.5 uniquement sur l'API Anthropic ; ailleurs, il signifie toujours Haiku 4.5. Voir Haiku 5.5 dans Claude Code pour les configurations de sous-agents.
Qui devrait passer à Haiku 5.5
- Vous utilisez Haiku 4.5 : changez, après avoir corrigé les cinq changements incompatibles. Haiku 5.5 surpasse Haiku 4.5 sur chaque ligne du tableau de lancement où les deux ont un score, à un prix catalogue inférieur.
- Vous utilisez Sonnet ou Opus pour des tâches simples et répétées : testez Haiku 5.5 pour la classification, l'extraction, les résumés et le travail de sous-agent. Gardez le modèle plus grand pour le codage agentique complexe.
- Vos invites dépassent souvent 100 000 jetons : évaluez les prix des deux niveaux avant de vous engager. Au-delà du seuil, l'entrée coûte 5 fois plus cher par jeton.
- Vous faites du travail de sécurité : les protections cyber de Haiku 5.5 bloquent toujours les tests d'intrusion.
Dans l'article de lancement d'Anthropic, Asana signale une latence de plus de 30 % inférieure pour l'achèvement des tâches, et Box a constaté un score de 11 points supérieur à Haiku 4.5 avec environ la moitié de la latence. Ce sont des affirmations de clients, pas des tests indépendants.
La fiche système note qu'il a refusé davantage que tout autre modèle lors de l'audit automatisé d'Anthropic, testez donc les taux de refus sur vos propres invites.
Envoyez votre première requête Haiku 5.5
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
]
}'
Omettez les paramètres d'échantillonnage et le préremplissage. Lisez les blocs de contenu par type, car la réponse peut commencer par un bloc de réflexion.
Dans Apidog, importez la commande curl comme une nouvelle requête et stockez la clé dans une variable d'environnement ANTHROPIC_API_KEY. Ajoutez des assertions pour que stop_reason ne soit pas refusal ou max_tokens. Dupliquez ensuite la requête à medium et comparez usage pour voir ce que coûte chaque niveau d'effort. Le guide de l'API Haiku 5.5 couvre la mise en cache, le traitement par lots et le streaming, et le guide de la clé API Anthropic vous aide si vous avez besoin d'une clé.
FAQ
Quand Claude Haiku 5.5 a-t-il été lancé ? Le 7 octobre 2026, neuf jours après Sonnet 5.5.
Claude Haiku 5.5 est-il gratuit ? Dans l'application de chat Claude.ai, les utilisateurs gratuits peuvent le sélectionner. L'API est payante, à l'exception de petits crédits de test pour les nouveaux utilisateurs. Voir tous les accès gratuits.
Quelle est la fenêtre contextuelle de Claude Haiku 5.5 ? 1 million de jetons, avec une sortie maximale de 128 000 sur l'API Messages.
Haiku 4.5 est-il retiré ? Pas encore. Il est toujours listé comme actif, avec un retrait pas avant le 15 octobre 2026.
Étape suivante
Choisissez une tâche à fort volume que vous effectuez aujourd'hui, comme le triage de tickets ou les résumés de documents. Envoyez-la à claude-haiku-5-5 à un effort low et medium, vérifiez la sortie et comparez l'usage avec votre modèle actuel. Téléchargez Apidog pour conserver ces requêtes et assertions dans un seul projet, puis utilisez le guide de tarification pour convertir les nombres de jetons en une facture mensuelle.
