Qu'est-ce que Claude Haiku 5.5

Qu'est-ce que Claude Haiku 5.5 ? Le modèle d'Anthropic du 7 octobre 2026 : 0,10 $/0,50 $ pour des invites jusqu'à 100 000 jetons, 1 million de contexte, les benchmarks et les changements par rapport à Haiku 4.5.

Ashley Innocent

Ashley Innocent

8 October 2026

Qu'est-ce que Claude Haiku 5.5

Apidog pour les entreprises

Déploiement sur site

SSO & RBAC

Conforme SOC 2

Découvrir Apidog Enterprise

Claude Haiku 5.5 est le modèle actuel le plus petit et le plus rapide d'Anthropic, lancé le 7 octobre 2026, avec l'ID d'API claude-haiku-5-5. Il coûte 0,10 $ par million de jetons d'entrée et 0,50 $ par million de jetons de sortie pour les invites jusqu'à 100 000 jetons, et 0,50 $/2,50 $ pour les invites de plus de 100 000 jetons. Dans son article de lancement, Anthropic déclare qu'il coûte "environ 75 % moins cher à exécuter" que Haiku 4.5 en moyenne, et le qualifie de "notre modèle le plus rapide à ce jour". C'est aussi le premier Haiku avec un paramètre d'effort, et il offre une fenêtre contextuelle de 1 million de jetons.

Ci-dessous : les spécifications, le prix à deux niveaux, les changements par rapport à Haiku 4.5, les benchmarks, où l'exécuter et qui devrait l'adopter, avec des liens vers des guides plus approfondis comme la répartition des prix de Haiku 5.5. Pour appeler le modèle pendant votre lecture, Apidog peut envoyer la requête Messages, conserver votre clé dans une variable d'environnement et afficher la réponse à côté de son utilisation de jetons.

bouton

Spécifications de Claude Haiku 5.5 en un coup d'œil

Spécification Claude Haiku 5.5
Date de sortie 7 octobre 2026
ID du modèle (API Claude, Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS) claude-haiku-5-5 (ID fixe, pas de suffixe de date)
ID du modèle (Amazon Bedrock) anthropic.claude-haiku-5-5
Fenêtre contextuelle 1 million de jetons (Haiku 4.5 : 200 000)
Sortie maximale 128 000 (Haiku 4.5 : 64 000) ; 300 000 sur l'API Batch avec l'en-tête bêta output-300k-2026-03-24
Réflexion Adaptative uniquement
Niveaux d'effort low (faible), medium (moyen, par défaut), high (élevé), xhigh (très élevé), max (maximum)
Date limite de connaissance Juin 2026
Prix par MJetons, invites jusqu'à 100 000 jetons 0,10 $ en entrée, 0,50 $ en sortie
Prix par MJetons, invites de plus de 100 000 jetons 0,50 $ en entrée, 2,50 $ en sortie
Retrait Pas avant le 7 octobre 2027

Place de Haiku 5.5 dans la gamme Claude

Modèle Entrée / sortie par MJetons Effort par défaut Latence
Claude Fable 5.1 10 $ / 50 $ élevé Plus lent
Claude Opus 5.5 4 $ / 20 $ moyen Modérée
Claude Sonnet 5.5 2 $ / 10 $ élevé Rapide
Claude Haiku 5.5 0,10 $ / 0,50 $ pour les invites jusqu'à 100 000 jetons moyen Le plus rapide

Les quatre partagent une fenêtre contextuelle de 1M, une sortie maximale de 128K et une date limite de connaissance de juin 2026. Anthropic a conçu Haiku 5.5 "pour les tâches à fort volume et sensibles à la latence telles que la classification, l'extraction et le routage", ainsi que les résumés, le support en direct, l'utilisation du navigateur et le travail de sous-agent sous Opus 5.5 ou Sonnet 5.5.

L'affirmation de vitesse a une note de bas de page : le plus rapide "à la vitesse standard de chaque modèle", mais plus lent qu'Opus en mode Rapide. Anthropic ne publie pas de chiffre de jetons par seconde.

Tarification de Claude Haiku 5.5

Le prix dépend de la longueur de l'invite. Une invite de plus de 100 000 jetons paie le tarif le plus élevé.

Graphique des prix de Claude Haiku 5.5

Source : Tarification de l'API Claude.

Le chiffre "environ 75 % moins cher" est une moyenne : 90 % moins cher que Haiku 4.5 pour les invites jusqu'à 100 000 jetons, 50 % moins cher au-delà, 90 % des requêtes Haiku 4.5 étant en dessous du seuil. Il prend déjà en compte le nouveau tokenizer, qui produit environ 30 % de jetons en plus pour le même texte.

L'inférence US uniquement (inference_geo) coûte 1,1 fois plus cher sur chaque catégorie de jetons. L'invite minimale cacheable tombe à 512 jetons, contre 4 096 sur Haiku 4.5.

En dessous de 100 000 jetons, le prix catalogue correspond exactement à GPT-6 Luna (0,10 $ en entrée, 0,50 $ en sortie, 0,01 $ en lecture de cache, 0,125 $ en écriture de cache). Les seuils diffèrent : le supplément de Luna commence au-delà de 272 000 jetons d'entrée. La comparaison Haiku 5.5 vs GPT-6 Luna explore cet écart, et le guide de tarification contient des exemples de coûts calculés.

Ce qui a changé par rapport à Haiku 4.5

La fenêtre contextuelle est multipliée par cinq, la sortie maximale double, et vous obtenez un contrôle d'effort pour la première fois. Le guide de migration avertit que le code écrit pour Haiku 4.5 peut ne plus fonctionner. Cinq changements entraînent une erreur 400 :

  1. Budgets de réflexion manuels. thinking: {"type": "enabled", "budget_tokens": N} échoue. Utilisez {"type": "adaptive"} avec output_config.effort.
  2. Paramètres d'échantillonnage. Supprimez temperature, top_p et top_k. Les valeurs non par défaut de temperature ou top_p échouent, tout comme tout top_k ou l'envoi simultané de temperature et top_p.
  3. Préremplissage de l'assistant. Rejeté, même avec la réflexion désactivée.
  4. Ancien outil d'utilisation d'ordinateur. Sur l'API Claude et Google Cloud, utilisez computer_toolset_20260801 ; computer_20250124 échoue.
  5. Historique modifié. La modification de system, tools ou des messages précédents avant un bloc de réflexion renvoyé échoue. Gardez les conversations en mode ajout uniquement.

D'autres changements n'entraîneront pas d'erreur mais modifieront vos résultats :

La réflexion peut être désactivée sur l'API à un effort high ou inférieur ; à xhigh et max, cela renvoie une erreur 400. Haiku 4.5 n'est pas déprécié : il est toujours listé comme actif. Le guide Haiku 5.5 vs Haiku 4.5 contient des JSON avant/après pour chaque correction.

Benchmarks de Claude Haiku 5.5

Les scores de Haiku 5.5 sont à effort maximal, pour la plupart moyennés sur cinq essais. Artificial Analysis a exécuté GDPval-AA et AA-Briefcase, Cognition a exécuté FrontierCode, et Anthropic a noté Chartography (un benchmark de Surge AI) avec sa propre implémentation.

Graphique des benchmarks de Claude Haiku 5.5

Lisez attentivement trois cellules. FrontierCode met Haiku au maximum contre Sonnet 5.5 à xhigh ; au maximum, Sonnet a obtenu 46,2 %, en dessous des 46,4 % de Haiku. Anthropic a exécuté le score OSWorld de Luna via l'API d'OpenAI, tandis que le score Terminal-Bench de Luna provient du classement public (Codex CLI). Et à l'effort medium par défaut, Haiku 5.5 a obtenu 1277 sur GDPval-AA et 1372 sur AA-Briefcase.

Anthropic affirme que Sonnet 5.5 et Opus 5.5 "restent de meilleurs choix pour les tâches de codage agentiques complexes". Aucun classement indépendant n'avait de résultat Haiku 5.5 au 8 octobre 2026 ; Cursor rapporte 48,4 % sur son propre CursorBench au maximum. L'analyse approfondie des benchmarks contient les scores et les coûts par niveau d'effort.

Où vous pouvez utiliser Claude Haiku 5.5

Surface Accès Remarques
API Claude claude-haiku-5-5 Paiement par jeton
Amazon Bedrock anthropic.claude-haiku-5-5 Facturé via AWS Marketplace
Google Cloud, Microsoft Foundry, Plateforme Claude sur AWS claude-haiku-5-5 Même ID que l'API Claude
Claude.ai (web, iOS, Android) Sélecteur de modèle Les utilisateurs Free, Pro, Max, Team et Enterprise peuvent le sélectionner
Claude Code /model claude-haiku-5-5 v2.1.293 ou ultérieure ; forfaits payants
Vercel AI Gateway anthropic/claude-haiku-5.5 À partir de 0,10 $ / 0,50 $
Cursor claude-haiku-5-5 Pool Autres Modèles

Au 8 octobre 2026, il n'était pas disponible sur OpenRouter ni annoncé pour GitHub Copilot.

L'accès au chat sur le forfait Gratuit n'est pas une clé API, et l'API est payante à l'utilisation au-delà du petit crédit gratuit qu'Anthropic offre aux nouveaux utilisateurs pour les tests. Les forfaits Max et Team incluent désormais des crédits API mensuels (100 $ sur Max 5x, 200 $ sur Max 20x, jusqu'à 500 $ mutualisés sur Team), qui ne couvrent pas Claude Code. Le guide d'accès gratuit liste ce qui est gratuit et ce qui ne l'est pas.

Dans Claude Code, l'alias haiku signifie Haiku 5.5 uniquement sur l'API Anthropic ; ailleurs, il signifie toujours Haiku 4.5. Voir Haiku 5.5 dans Claude Code pour les configurations de sous-agents.

Qui devrait passer à Haiku 5.5

Dans l'article de lancement d'Anthropic, Asana signale une latence de plus de 30 % inférieure pour l'achèvement des tâches, et Box a constaté un score de 11 points supérieur à Haiku 4.5 avec environ la moitié de la latence. Ce sont des affirmations de clients, pas des tests indépendants.

La fiche système note qu'il a refusé davantage que tout autre modèle lors de l'audit automatisé d'Anthropic, testez donc les taux de refus sur vos propres invites.

Envoyez votre première requête Haiku 5.5

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
    ]
  }'

Omettez les paramètres d'échantillonnage et le préremplissage. Lisez les blocs de contenu par type, car la réponse peut commencer par un bloc de réflexion.

Dans Apidog, importez la commande curl comme une nouvelle requête et stockez la clé dans une variable d'environnement ANTHROPIC_API_KEY. Ajoutez des assertions pour que stop_reason ne soit pas refusal ou max_tokens. Dupliquez ensuite la requête à medium et comparez usage pour voir ce que coûte chaque niveau d'effort. Le guide de l'API Haiku 5.5 couvre la mise en cache, le traitement par lots et le streaming, et le guide de la clé API Anthropic vous aide si vous avez besoin d'une clé.

FAQ

Quand Claude Haiku 5.5 a-t-il été lancé ? Le 7 octobre 2026, neuf jours après Sonnet 5.5.

Claude Haiku 5.5 est-il gratuit ? Dans l'application de chat Claude.ai, les utilisateurs gratuits peuvent le sélectionner. L'API est payante, à l'exception de petits crédits de test pour les nouveaux utilisateurs. Voir tous les accès gratuits.

Quelle est la fenêtre contextuelle de Claude Haiku 5.5 ? 1 million de jetons, avec une sortie maximale de 128 000 sur l'API Messages.

Haiku 4.5 est-il retiré ? Pas encore. Il est toujours listé comme actif, avec un retrait pas avant le 15 octobre 2026.

Étape suivante

Choisissez une tâche à fort volume que vous effectuez aujourd'hui, comme le triage de tickets ou les résumés de documents. Envoyez-la à claude-haiku-5-5 à un effort low et medium, vérifiez la sortie et comparez l'usage avec votre modèle actuel. Téléchargez Apidog pour conserver ces requêtes et assertions dans un seul projet, puis utilisez le guide de tarification pour convertir les nombres de jetons en une facture mensuelle.

Pratiquez le Design-first d'API dans Apidog

Découvrez une manière plus simple de créer et utiliser des API