Claude Haiku 5.5 coûte 0,10 $ par million de jetons d'entrée et 0,50 $ par million de jetons de sortie pour les invites allant jusqu'à 100 000 jetons. Une invite de plus de 100 000 jetons paie des prix plus élevés : 0,50 $ en entrée et 2,50 $ en sortie. Les lectures de cache commencent à 0,01 $, l'API Batch réduit tous les tarifs de moitié, et Anthropic affirme que le modèle coûte « environ 75 % moins cher à exécuter » que Haiku 4.5 en moyenne.
Ce guide couvre chaque élément de coût, le calcul derrière ces 75 %, trois exemples pratiques (dont un dépassant 100 000), le coût par niveau d'effort, et comment Haiku 5.5 se compare à Haiku 4.5, GPT-6 Luna et Sonnet 5.5. Nouveau au modèle ? Commencez par ce qu'est Claude Haiku 5.5. Pour vérifier les chiffres sur votre propre trafic, envoyez des requêtes depuis Apidog et lisez le bloc usage de chaque réponse.
Tableau des prix de l'API Claude Haiku 5.5
Prix par million de jetons (MTok), d'après la documentation tarifaire d'Anthropic :
| Poste | Invites jusqu'à 100 000 jetons | Invites de plus de 100 000 jetons |
|---|---|---|
| Entrée | $0.10 | $0.50 |
| Sortie | $0.50 | $2.50 |
| Écriture cache de 5 minutes | $0.125 | $0.625 |
| Écriture cache d'une heure | $0.20 | $1.00 |
| Lecture cache (succès et actualisations) | $0.01 | $0.05 |
| Entrée par lot | $0.05 | $0.25 |
| Sortie par lot | $0.25 | $1.25 |
La documentation l'indique clairement : « une invite de plus de 100 000 jetons paie des prix plus élevés ». Les autres modèles Claude à partir de la version 4.6 facturent la fenêtre complète de 1M à un seul tarif ; Haiku 5.5 est l'exception. À noter également :
- Inférénce uniquement aux États-Unis. Le routage uniquement aux États-Unis via
inference_geocoûte 1,1 fois plus cher sur chaque catégorie de jetons de l'API Claude et de la plateforme Claude sur AWS : 0,11 $ en entrée et 0,55 $ en sortie pour moins de 100 000. - Un nouveau tokeniseur. Le même texte produit environ 30 % de jetons en plus qu'avec Haiku 4.5.
- Coût des outils réduit. L'invite système d'utilisation des outils est de 286 jetons (auto/aucun), contre 496 avec Haiku 4.5.
- Pas de niveau de priorité (Priority Tier) et pas de mode rapide.
D'où vient le « environ 75 % de moins »
Haiku 5.5 est tarifé 90 % moins cher que Haiku 4.5 jusqu'à 100 000 jetons et 50 % moins cher au-delà ; 90 % des requêtes Haiku 4.5 étaient inférieures à 100 000 ; et le chiffre tient compte du nouveau tokeniseur. Une reconstruction approximative :
- Pondération par nombre de requêtes : 0,9 × 90 % + 0,1 × 50 % = 86 % de réduction.
- Ajouter environ 30 % de jetons en plus : les 14 % restants du coût deviennent 14 % × 1,3 = 18,2 %, de sorte que l'économie tombe à environ 82 %.

Le chiffre d'Anthropic est encore plus bas. Il ne publie pas la pondération, et les invites longues représentent probablement une part plus importante des dépenses que du nombre de requêtes. Considérez 75 % comme une moyenne ; vos données usage sont la vraie réponse.
Coût par tentative à chaque niveau d'effort
Haiku 5.5 est le premier Haiku avec des niveaux d'effort (de low à max ; medium est la valeur par défaut de l'API), et l'effort influence votre facture plus que la grille tarifaire. Ces chiffres proviennent des graphiques par niveau d'effort du message de lancement. Anthropic a exécuté OSWorld et Terminal-Bench ; Artificial Analysis a exécuté GDPval-AA :
| Effort | OSWorld 2.1 (score, $/tentative) | GDPval-AA v2.1 (Elo, $/tâche) | Terminal-Bench 4.0 (score, $/tentative) |
|---|---|---|---|
| low | 42.0%, $0.0695 | 1125, $0.0117 | 12.7%, $0.424 |
| medium | 53.3%, $0.1257 | 1277, $0.0304 | 20.3%, $0.6798 |
| high | 61.3%, $0.1827 | 1420, $0.0894 | 24.8%, $1.0372 |
| xhigh | 67.6%, $0.2792 | 1513, $0.2673 | 31.5%, $1.7545 |
| max | 72.4%, $0.6111 | 1620, $0.8659 | 39.2%, $2.6433 |
Ce qui ressort :
- Max coûte 4,9 fois plus cher que medium sur OSWorld (0,6111 $ ÷ 0,1257 $) et 28,5 fois plus cher que medium sur GDPval-AA (0,86593 $ ÷ 0,03042 $).
- Les scores du tableau de lancement correspondent à l'effort max. Par défaut, avec
medium, GDPval-AA est de 1277, pas 1620. - Pour le codage agentique, consultez Sonnet. Sur Terminal-Bench, Sonnet 5.5 à
low(avec des lectures de cache à 0,10 $) a obtenu 20 % pour 0,6205 $, contre Haiku 5.5 àmediumavec 20,3 % pour 0,6798 $. Anthropic affirme que Sonnet et Opus « restent de meilleurs choix pour les tâches de codage agentique complexes ». Notre analyse des benchmarks contient toutes les lignes.
Comment Haiku 5.5 se compare en termes de prix
| Modèle | Entrée / sortie par MJetons | Lecture cache | Écriture cache 5min | Règle des invites longues |
|---|---|---|---|---|
| Claude Haiku 5.5 | Jusqu'à 100K : $0.10 / $0.50 | $0.01 | $0.125 | Plus de 100K : $0.50 / $2.50 |
| GPT-6 Luna | $0.10 / $0.50 | $0.01 | $0.125 | Entrée de plus de 272K : 2x entrée et cache, 1,5x sortie ($0.20 / $0.75) |
| Claude Haiku 4.5 | $1 / $5 | $0.10 | $1.25 | Tarif unique (contexte 200K) |
| Claude Sonnet 5.5 | $2 / $10 | $0.10 | $2.50 | Tarif unique sur 1M |
GPT-6 Luna correspond à Haiku 5.5 jusqu'à 100 000 ; le seuil diffère. Selon la page du modèle d'OpenAI, la majoration Luna commence au-delà de 272 000 et s'applique « pour la requête entière ». L'appel de l'exemple 3 reste au tarif de base de Luna : (150 000 × 0,10 $ + 2 000 × 0,50 $) ÷ 1 000 000 = 0,016 $, contre 0,08 $ sur Haiku 5.5. Les tokeniseurs diffèrent également : un commentateur de Hacker News a estimé que 100 000 jetons Claude équivalent à environ 60-65 000 jetons GPT. Sur le graphique OSWorld d'Anthropic, Haiku 5.5 à medium (53,3 %, 0,1257 $) a battu Luna à max (48,9 %, 0,205 $). Plus de détails dans Claude Haiku 5.5 vs GPT-6 Luna.
Sonnet 5.5 a réduit les lectures de cache de 0,20 $ à 0,10 $ le même jour, soit environ 20 % moins cher sur la plupart des tâches agentiques selon Anthropic. Notre guide tarifaire de Sonnet 5.5 est antérieur à cette réduction.
Haiku 4.5 n'est pas obsolète ; Haiku 5.5 vs Haiku 4.5 énumère les changements majeurs à corriger en premier.
Crédits API et forfaits consommateurs
Crédits API Max et Team. Max 5x reçoit 100 $ par mois en crédits Claude Platform, Max 20x 200 $, et Team 20 $ par siège Standard et 100 $ par siège Premium, cumulés et plafonnés à 500 $. Les plans Gratuit, Pro et Enterprise ne sont pas éligibles. Selon la documentation des crédits API, ils couvrent l'API Claude, et non Claude Code ou les services cloud, et ne sont pas reportables. À 0,10 $ par MJetons, 100 $ permettent d'acheter 1 milliard de jetons d'entrée, soit environ 220 000 requêtes de l'Exemple 1 (100 $ ÷ 0,000455 $).
Forfaits consommateurs (claude.com/pricing) : Les utilisateurs des forfaits Gratuit (0 $), Pro, Max, Team et Enterprise peuvent sélectionner Haiku 5.5 sur Claude.ai sur le web, iOS et Android. Le forfait Pro coûte 17 $/mois facturé annuellement ou 20 $ par mois ; Max commence à 100 $/mois. Le forfait Gratuit n'inclut pas Claude Code, et un forfait de chat ne peut pas exécuter un script ou un travail d'intégration continue. Comment utiliser Claude Haiku 5.5 gratuitement couvre le reste.
Clouds. Bedrock, Google Cloud et Foundry facturent Haiku 5.5 via leurs propres pages tarifaires.
Suivre le coût par requête dans Apidog
Chaque réponse Messages renvoie un objet usage, ce qui est suffisant pour tarifer un appel dans Apidog :
- Stockez votre clé en tant que variable d'environnement
ANTHROPIC_API_KEY. - Enregistrez cette requête une fois par niveau d'effort (
low,medium,high) avec la même invite :
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- Ajoutez un post-processeur qui choisit le niveau et évalue le coût de l'appel. Il traite les
input_tokenscomme la longueur de l'invite, ce qui tient sans mise en cache :
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost = (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => pm.expect(body.stop_reason).to.not.eql("refusal"));
- Exécutez les trois et comparez les jetons de sortie et le coût côte à côte.
La vérification de refus est importante car les classificateurs de sécurité de Haiku 5.5 n'ont pas de repli côté serveur. Le guide complet se trouve dans comment utiliser l'API Claude Haiku 5.5.
FAQ
Combien coûte Claude Haiku 5.5 par million de jetons ? 0,10 $ en entrée et 0,50 $ en sortie pour les invites jusqu'à 100 000 jetons ; 0,50 $ et 2,50 $ au-delà.
Haiku 5.5 est-il moins cher que Haiku 4.5 ? Oui : 90 % moins cher par jeton jusqu'à 100 000, 50 % au-delà, et environ 75 % en moyenne selon Anthropic.
Haiku 5.5 est-il au même prix que GPT-6 Luna ? Jusqu'à 100 000, oui. Au-delà, Haiku 5.5 augmente de 5x ; Luna reste stable jusqu'à 272 000. Notre aperçu de GPT-6 Luna contient les détails.
Les crédits du forfait Max fonctionnent-ils dans Claude Code ? Non. Ils couvrent l'API Claude Platform, pas Claude Code. Consultez Claude Haiku 5.5 dans Claude Code pour l'accès aux forfaits là-bas.
Étape suivante : estimez le coût de votre propre charge de travail
Extrayez vos trois types de requêtes les plus courants, vérifiez combien dépassent 100 000, et exécutez chacune avec les niveaux d'effort low et medium. Multipliez les chiffres d'usage par le tableau ci-dessus pour obtenir votre économie réelle. Téléchargez Apidog pour conserver ces requêtes et le script de coût dans un seul projet.
