Aller au contenu principal
Intelligence Artificielle6 min de lecture

Claude Haiku 5.5 : combien économise-t-on vraiment ?

Olivier Démontant·8 octobre 2026
Partager
Claude Haiku 5.5 face à Haiku 4.5 : comparaison des prix du token

Claude Haiku 5.5 : combien économise-t-on vraiment ?

Claude Haiku 5.5, sorti le 7 octobre 2026, coûte 0,10 $ par million de tokens en entrée et 0,50 $ en sortie, contre 1 $ et 5 $ pour Claude Haiku 4.5. Sur le papier, c'est dix fois moins cher. Sur une facture réelle, l'économie est plus modeste : le nouveau modèle compte environ 30 % de tokens en plus pour le même texte, et son tarif remonte pour les prompts de plus de 100 000 tokens. Anthropic annonce d'ailleurs environ 75 % de réduction en moyenne, pas 90 %.

Voici le calcul, un exemple chiffré sur un volume de PME, et les cas où Haiku 5.5 remplace Sonnet 5.5 ou son prédécesseur, et ceux où il ne le remplace pas.

En bref

  • Prix : 0,10 $ / 0,50 $ par million de tokens (entrée / sortie) pour les prompts jusqu'à 100 000 tokens, contre 1 $ / 5 $ pour Haiku 4.5.
  • Au-delà de 100 000 tokens : 0,50 $ / 2,50 $, soit 50 % de moins que Haiku 4.5 seulement.
  • Économie réelle : environ 75 % en moyenne selon Anthropic, car le nouveau tokenizer compte environ 30 % de tokens en plus.
  • Capacités : 1 million de tokens de contexte, 128 000 tokens de sortie, identifiant claude-haiku-5-5.
  • Usage visé : classification, extraction, routage, sous-agents. Sonnet 5.5 et Opus 5.5 restent meilleurs pour le code agentique complexe.
  • Migration : Haiku 4.5 reste actif, sans date de retrait annoncée. Le code existant demande des ajustements.

Mis à jour le 8 octobre 2026, à partir de la documentation officielle d'Anthropic (page des modèles, tarifs, dépréciations et annonce du 7 octobre).

Combien coûte Claude Haiku 5.5 ?

Haiku 5.5 est le plus petit modèle de la gamme Claude. Anthropic le destine au volume et à la rapidité : classification, extraction, routage. C'est aussi le plus rapide de la gamme actuelle, d'après la page comparative des modèles.

Son tarif a une particularité : il dépend de la taille du prompt. Les autres modèles récents facturent le même prix par token sur tout leur million de tokens de contexte. Haiku 5.5 applique un prix pour les prompts jusqu'à 100 000 tokens, et un prix plus élevé au-delà.

Modèle Entrée / sortie (par million de tokens) Lecture de cache Contexte
Haiku 5.5, prompt jusqu'à 100 000 tokens 0,10 $ / 0,50 $ 0,01 $ 1 M
Haiku 5.5, prompt au-delà de 100 000 tokens 0,50 $ / 2,50 $ 0,05 $ 1 M
Haiku 4.5 1 $ / 5 $ 0,10 $ 200 K
Sonnet 5.5 2 $ / 10 $ 0,10 $ 1 M
Opus 5.5 4 $ / 20 $ 0,20 $ 1 M

Prix de sortie par million de tokens : Opus 5.5 20 $, Sonnet 5.5 10 $, Haiku 4.5 5 $, Haiku 5.5 0,50 $

Les requêtes envoyées en mode Batch (traitement différé, sans réponse immédiate) bénéficient en plus de 50 % de réduction, soit 0,05 $ en entrée et 0,25 $ en sortie pour les prompts courts.

Quelle économie réelle sur une facture ?

Le prix au token baisse de 90 % jusqu'à 100 000 tokens. Mais Haiku 5.5 utilise le même tokenizer que les modèles Claude 4.7 et suivants : le même texte produit environ 30 % de tokens en plus que sur Haiku 4.5, avec une variation selon le contenu. Prenons un texte qui représente 1 million de tokens en entrée sur Haiku 4.5 : il coûte 1 $ sur Haiku 4.5 et 0,10 $ × 1,3 = 0,13 $ sur Haiku 5.5, soit environ 87 % de moins. Au-delà de 100 000 tokens, 0,50 $ × 1,3 = 0,65 $ : l'économie tombe à environ 35 %. Ce sont mes calculs, à partir des tarifs publiés. Anthropic donne de son côté environ 75 % de moins en moyenne, ce qui dépend de votre mélange de requêtes.

Voici un exemple de calcul, pas un cas client. Une PME trie 10 000 emails par mois. Hypothèse : 500 tokens en entrée et 50 en sortie par email, mesurés avec le tokenizer de Haiku 4.5, soit 30 % de plus sur les modèles récents.

Modèle Calcul Coût mensuel
Haiku 4.5 5 M tokens × 1 $ + 0,5 M × 5 $ 7,50 $
Haiku 5.5 6,5 M × 0,10 $ + 0,65 M × 0,50 $ 0,98 $
Haiku 5.5 en Batch moitié du précédent 0,49 $
Sonnet 5.5 6,5 M × 2 $ + 0,65 M × 10 $ 19,50 $

Sur ce volume, l'écart se compte en dollars par mois, pas en milliers. Haiku 5.5 revient environ 87 % moins cher que Haiku 4.5 et vingt fois moins cher que Sonnet 5.5. L'effet devient significatif à partir de plusieurs millions de requêtes, ou quand chaque requête embarque un long contexte.

Un point peut grignoter ce gain : la réflexion adaptative est activée par défaut et le niveau d'effort par défaut est medium. Les tokens de réflexion comptent dans la limite max_tokens et sont facturés. Pour de la classification simple, fixez l'effort à low et mesurez.

Pour quels usages choisir Haiku 5.5 ?

Anthropic cite la classification, l'extraction, le routage et le travail de sous-agent, par exemple un Haiku qui exécute les tâches simples pendant qu'un Sonnet ou un Opus pilote. Dans un workflow d'automatisation, c'est le cas typique : trier des emails entrants, qualifier des leads, extraire des champs d'un document.

Sur le raisonnement et le code, Haiku 5.5 reste derrière. Sur Terminal-Bench 4.0, un test d'agent en ligne de commande, Anthropic publie 39,2 % pour Haiku 5.5, contre 0,0 % pour Haiku 4.5 et 70,6 % pour Sonnet 5.5. Ces chiffres viennent du constructeur, pas d'un test indépendant. Anthropic précise lui-même que Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour le code agentique complexe.

La règle pratique : Haiku 5.5 pour le volume, la vitesse et les tâches bien cadrées, Sonnet 5.5 par défaut pour le reste, Opus 5.5 pour le travail long et ambigu. Pour choisir entre ces deux derniers, lisez Sonnet 5.5 et Opus 5.5 : ce qui change vraiment.

Faut-il migrer de Haiku 4.5 maintenant ?

Rien n'y oblige. Haiku 4.5 est toujours actif et Anthropic n'a annoncé aucune date de retrait. L'entreprise s'est engagée à ne pas le retirer avant le 15 octobre 2026, ce qui est un plancher et non une échéance, mais mieux vaut planifier la bascule.

Le code existant ne passe pas tel quel. D'après la documentation d'Anthropic, Haiku 5.5 renvoie une erreur si vous envoyez une valeur non par défaut pour temperature, top_p ou top_k, un budget de réflexion manuel (budget_tokens) ou un message assistant en préremplissage. Une réponse peut aussi commencer par un bloc de réflexion : lisez les blocs par leur type, pas par leur position. Enfin, Haiku 5.5 peut désormais refuser une requête (stop_reason: "refusal"), sans bascule automatique côté serveur.

Avant de basculer une automatisation en production, rejouez 20 à 30 cas réels sur Haiku 4.5 et Haiku 5.5, et comparez le coût et la qualité. Les moyennes du constructeur ne remplacent pas votre propre mesure.

Ce qu'il faut retenir

  • Haiku 5.5 coûte 0,10 $ en entrée, 0,50 $ en sortie.
  • Le prix au token baisse de 90 %.
  • Le nouveau tokenizer compte environ 30 % de tokens en plus.
  • Anthropic annonce environ 75 % d'économie en moyenne.
  • Au-delà de 100 000 tokens, l'économie tombe à 35-50 %.
  • Haiku 5.5 : volume et tâches simples. Sonnet 5.5 : le reste.
  • Testez sur vos cas avant de migrer.

Questions fréquentes

Claude Haiku 5.5 est-il vraiment dix fois moins cher que Haiku 4.5 ? Au token, oui, pour les prompts jusqu'à 100 000 tokens. Par tâche, moins : le nouveau tokenizer compte environ 30 % de tokens en plus, ce qui ramène l'économie à environ 87 % sur un texte identique. Anthropic annonce environ 75 % de moins en moyenne.

Quand utiliser Haiku 5.5 plutôt que Sonnet 5.5 ? Quand la tâche est simple, répétitive et à fort volume : classification, extraction, routage, tri d'emails. Sonnet 5.5 coûte vingt fois plus cher, mais reste plus fort sur le raisonnement et le code agentique.

Haiku 4.5 va-t-il être retiré ? Aucune date de retrait n'est annoncée. Anthropic s'engage à ne pas le retirer avant le 15 octobre 2026, ce qui est un plancher. La page des dépréciations donne le statut à jour.

Quel est l'identifiant API de Haiku 5.5 ? claude-haiku-5-5 sur l'API Claude, Google Cloud, Microsoft Foundry et Claude Platform on AWS, et anthropic.claude-haiku-5-5 sur Amazon Bedrock.

Sources


Pour aller plus loin, lisez comment choisir le bon LLM pour son entreprise. Si vous voulez brancher ces modèles sur vos process, c'est l'objet de mon service d'automatisation et IA.

Si vous voulez savoir quel modèle convient à votre cas, on peut en parler. Le premier échange est gratuit : contactez-moi ou réservez un appel.

Olivier Démontant, développeur web freelance, intègre l'IA et l'automatisation dans les process de PME.

Initiation à Claude — CreativConflans

Vous voulez vraiment prendre en main Claude pour votre activité ?

Une session de 2h en visio, appliquée à 2-3 cas concrets de votre métier — démo à l'appui. Vous repartez avec des choses qui marchent déjà, pas un rapport théorique.

Découvrir la session
Claude Haiku 5.5 Anthropic LLM Tarifs IA Automatisation

Un projet en tête ?

Discutons de votre projet web lors d'un appel gratuit et sans engagement.

À lire également

OpenAI DevDay 2026 : agents dots, GPT-6.1 Sol et tier ultrafast
Intelligence Artificielle

OpenAI DevDay 2026 : dots, GPT-6.1 Sol, ce qu'il faut retenir

OpenAI a présenté le 29 septembre ses agents dots, GPT-6.1 Sol et un tier ultrafast. Ce qui est annoncé, ce que ça coûte et ce que ça change pour une PME.

30 septembre 20264 min
Claude Sonnet 5.5 et Opus 5.5 : comparaison des prix et des performances
Intelligence Artificielle

Claude Sonnet 5.5 et Opus 5.5 : ce qui change vraiment

Opus 5.5 (22 septembre) et Sonnet 5.5 (28 septembre) : ce que disent réellement les sources officielles sur les prix, la vitesse et les benchmarks, et quel modèle choisir.

30 septembre 20267 min
Gemini 3.8 Flash TTS, nouveaux modèles de synthèse vocale Google
Intelligence Artificielle

Gemini 3.8 Flash TTS : la nouvelle synthèse vocale Google

Google lance Gemini 3.8 Flash TTS et Flash-Lite TTS le 23 septembre 2026 : clonage vocal en 30 secondes, 100+ langues et une bibliothèque de 2 000+ voix.

23 septembre 20264 min
Projet ou Skill Claude : quelle différence, et comment choisir ?
Intelligence Artificielle

Projet ou Skill Claude : quelle différence, et comment choisir ?

Projet Claude ou Skill Claude, quelle différence ? Définitions claires, cas d'usage concrets et comment les deux se complètent pour votre activité.

3 septembre 20263 min
Les commandes Claude Code essentielles et à quoi elles servent
Intelligence Artificielle

Les commandes Claude Code essentielles et à quoi elles servent

Claude Code a des dizaines de commandes slash — voici les plus utiles au quotidien, expliquées simplement : /clear, /compact, /model, /init et plus.

3 septembre 20263 min
Économiser les tokens sur Claude : les bons réflexes au quotidien
Intelligence Artificielle

Économiser les tokens sur Claude : les bons réflexes au quotidien

Claude facture en tokens. Voici les réflexes concrets pour réduire votre consommation sur Claude Desktop et Claude Code, avec de vrais chiffres de budget.

3 septembre 20265 min