Claude Haiku 5.5 : combien économise-t-on vraiment ?
Claude Haiku 5.5, sorti le 7 octobre 2026, coûte 0,10 $ par million de tokens en entrée et 0,50 $ en sortie, contre 1 $ et 5 $ pour Claude Haiku 4.5. Sur le papier, c'est dix fois moins cher. Sur une facture réelle, l'économie est plus modeste : le nouveau modèle compte environ 30 % de tokens en plus pour le même texte, et son tarif remonte pour les prompts de plus de 100 000 tokens. Anthropic annonce d'ailleurs environ 75 % de réduction en moyenne, pas 90 %.
Voici le calcul, un exemple chiffré sur un volume de PME, et les cas où Haiku 5.5 remplace Sonnet 5.5 ou son prédécesseur, et ceux où il ne le remplace pas.
En bref
- Prix : 0,10 $ / 0,50 $ par million de tokens (entrée / sortie) pour les prompts jusqu'à 100 000 tokens, contre 1 $ / 5 $ pour Haiku 4.5.
- Au-delà de 100 000 tokens : 0,50 $ / 2,50 $, soit 50 % de moins que Haiku 4.5 seulement.
- Économie réelle : environ 75 % en moyenne selon Anthropic, car le nouveau tokenizer compte environ 30 % de tokens en plus.
- Capacités : 1 million de tokens de contexte, 128 000 tokens de sortie, identifiant
claude-haiku-5-5.- Usage visé : classification, extraction, routage, sous-agents. Sonnet 5.5 et Opus 5.5 restent meilleurs pour le code agentique complexe.
- Migration : Haiku 4.5 reste actif, sans date de retrait annoncée. Le code existant demande des ajustements.
Mis à jour le 8 octobre 2026, à partir de la documentation officielle d'Anthropic (page des modèles, tarifs, dépréciations et annonce du 7 octobre).
Combien coûte Claude Haiku 5.5 ?
Haiku 5.5 est le plus petit modèle de la gamme Claude. Anthropic le destine au volume et à la rapidité : classification, extraction, routage. C'est aussi le plus rapide de la gamme actuelle, d'après la page comparative des modèles.
Son tarif a une particularité : il dépend de la taille du prompt. Les autres modèles récents facturent le même prix par token sur tout leur million de tokens de contexte. Haiku 5.5 applique un prix pour les prompts jusqu'à 100 000 tokens, et un prix plus élevé au-delà.
| Modèle | Entrée / sortie (par million de tokens) | Lecture de cache | Contexte |
|---|---|---|---|
| Haiku 5.5, prompt jusqu'à 100 000 tokens | 0,10 $ / 0,50 $ | 0,01 $ | 1 M |
| Haiku 5.5, prompt au-delà de 100 000 tokens | 0,50 $ / 2,50 $ | 0,05 $ | 1 M |
| Haiku 4.5 | 1 $ / 5 $ | 0,10 $ | 200 K |
| Sonnet 5.5 | 2 $ / 10 $ | 0,10 $ | 1 M |
| Opus 5.5 | 4 $ / 20 $ | 0,20 $ | 1 M |
Les requêtes envoyées en mode Batch (traitement différé, sans réponse immédiate) bénéficient en plus de 50 % de réduction, soit 0,05 $ en entrée et 0,25 $ en sortie pour les prompts courts.
Quelle économie réelle sur une facture ?
Le prix au token baisse de 90 % jusqu'à 100 000 tokens. Mais Haiku 5.5 utilise le même tokenizer que les modèles Claude 4.7 et suivants : le même texte produit environ 30 % de tokens en plus que sur Haiku 4.5, avec une variation selon le contenu. Prenons un texte qui représente 1 million de tokens en entrée sur Haiku 4.5 : il coûte 1 $ sur Haiku 4.5 et 0,10 $ × 1,3 = 0,13 $ sur Haiku 5.5, soit environ 87 % de moins. Au-delà de 100 000 tokens, 0,50 $ × 1,3 = 0,65 $ : l'économie tombe à environ 35 %. Ce sont mes calculs, à partir des tarifs publiés. Anthropic donne de son côté environ 75 % de moins en moyenne, ce qui dépend de votre mélange de requêtes.
Voici un exemple de calcul, pas un cas client. Une PME trie 10 000 emails par mois. Hypothèse : 500 tokens en entrée et 50 en sortie par email, mesurés avec le tokenizer de Haiku 4.5, soit 30 % de plus sur les modèles récents.
| Modèle | Calcul | Coût mensuel |
|---|---|---|
| Haiku 4.5 | 5 M tokens × 1 $ + 0,5 M × 5 $ | 7,50 $ |
| Haiku 5.5 | 6,5 M × 0,10 $ + 0,65 M × 0,50 $ | 0,98 $ |
| Haiku 5.5 en Batch | moitié du précédent | 0,49 $ |
| Sonnet 5.5 | 6,5 M × 2 $ + 0,65 M × 10 $ | 19,50 $ |
Sur ce volume, l'écart se compte en dollars par mois, pas en milliers. Haiku 5.5 revient environ 87 % moins cher que Haiku 4.5 et vingt fois moins cher que Sonnet 5.5. L'effet devient significatif à partir de plusieurs millions de requêtes, ou quand chaque requête embarque un long contexte.
Un point peut grignoter ce gain : la réflexion adaptative est activée par défaut et le niveau d'effort par défaut est medium. Les tokens de réflexion comptent dans la limite max_tokens et sont facturés. Pour de la classification simple, fixez l'effort à low et mesurez.
Pour quels usages choisir Haiku 5.5 ?
Anthropic cite la classification, l'extraction, le routage et le travail de sous-agent, par exemple un Haiku qui exécute les tâches simples pendant qu'un Sonnet ou un Opus pilote. Dans un workflow d'automatisation, c'est le cas typique : trier des emails entrants, qualifier des leads, extraire des champs d'un document.
Sur le raisonnement et le code, Haiku 5.5 reste derrière. Sur Terminal-Bench 4.0, un test d'agent en ligne de commande, Anthropic publie 39,2 % pour Haiku 5.5, contre 0,0 % pour Haiku 4.5 et 70,6 % pour Sonnet 5.5. Ces chiffres viennent du constructeur, pas d'un test indépendant. Anthropic précise lui-même que Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour le code agentique complexe.
La règle pratique : Haiku 5.5 pour le volume, la vitesse et les tâches bien cadrées, Sonnet 5.5 par défaut pour le reste, Opus 5.5 pour le travail long et ambigu. Pour choisir entre ces deux derniers, lisez Sonnet 5.5 et Opus 5.5 : ce qui change vraiment.
Faut-il migrer de Haiku 4.5 maintenant ?
Rien n'y oblige. Haiku 4.5 est toujours actif et Anthropic n'a annoncé aucune date de retrait. L'entreprise s'est engagée à ne pas le retirer avant le 15 octobre 2026, ce qui est un plancher et non une échéance, mais mieux vaut planifier la bascule.
Le code existant ne passe pas tel quel. D'après la documentation d'Anthropic, Haiku 5.5 renvoie une erreur si vous envoyez une valeur non par défaut pour temperature, top_p ou top_k, un budget de réflexion manuel (budget_tokens) ou un message assistant en préremplissage. Une réponse peut aussi commencer par un bloc de réflexion : lisez les blocs par leur type, pas par leur position. Enfin, Haiku 5.5 peut désormais refuser une requête (stop_reason: "refusal"), sans bascule automatique côté serveur.
Avant de basculer une automatisation en production, rejouez 20 à 30 cas réels sur Haiku 4.5 et Haiku 5.5, et comparez le coût et la qualité. Les moyennes du constructeur ne remplacent pas votre propre mesure.
Ce qu'il faut retenir
- Haiku 5.5 coûte 0,10 $ en entrée, 0,50 $ en sortie.
- Le prix au token baisse de 90 %.
- Le nouveau tokenizer compte environ 30 % de tokens en plus.
- Anthropic annonce environ 75 % d'économie en moyenne.
- Au-delà de 100 000 tokens, l'économie tombe à 35-50 %.
- Haiku 5.5 : volume et tâches simples. Sonnet 5.5 : le reste.
- Testez sur vos cas avant de migrer.
Questions fréquentes
Claude Haiku 5.5 est-il vraiment dix fois moins cher que Haiku 4.5 ? Au token, oui, pour les prompts jusqu'à 100 000 tokens. Par tâche, moins : le nouveau tokenizer compte environ 30 % de tokens en plus, ce qui ramène l'économie à environ 87 % sur un texte identique. Anthropic annonce environ 75 % de moins en moyenne.
Quand utiliser Haiku 5.5 plutôt que Sonnet 5.5 ? Quand la tâche est simple, répétitive et à fort volume : classification, extraction, routage, tri d'emails. Sonnet 5.5 coûte vingt fois plus cher, mais reste plus fort sur le raisonnement et le code agentique.
Haiku 4.5 va-t-il être retiré ? Aucune date de retrait n'est annoncée. Anthropic s'engage à ne pas le retirer avant le 15 octobre 2026, ce qui est un plancher. La page des dépréciations donne le statut à jour.
Quel est l'identifiant API de Haiku 5.5 ?
claude-haiku-5-5 sur l'API Claude, Google Cloud, Microsoft Foundry et Claude Platform on AWS, et anthropic.claude-haiku-5-5 sur Amazon Bedrock.
Sources
- Anthropic, annonce de Claude Haiku 5.5
- Anthropic, fiche Claude Haiku 5.5
- Anthropic, nouveautés de Claude Haiku 5.5
- Anthropic, Models overview
- Anthropic, tarifs de l'API
- Anthropic, dépréciations des modèles
Pour aller plus loin, lisez comment choisir le bon LLM pour son entreprise. Si vous voulez brancher ces modèles sur vos process, c'est l'objet de mon service d'automatisation et IA.
Si vous voulez savoir quel modèle convient à votre cas, on peut en parler. Le premier échange est gratuit : contactez-moi ou réservez un appel.
Olivier Démontant, développeur web freelance, intègre l'IA et l'automatisation dans les process de PME.
Initiation à Claude — CreativConflans
Vous voulez vraiment prendre en main Claude pour votre activité ?
Une session de 2h en visio, appliquée à 2-3 cas concrets de votre métier — démo à l'appui. Vous repartez avec des choses qui marchent déjà, pas un rapport théorique.
Un projet en tête ?
Discutons de votre projet web lors d'un appel gratuit et sans engagement.






