Claude Haiku 5.5 affiche 0,10 dollar par million de tokens en entrée, dix fois moins que son prédécesseur, et pourtant Anthropic ne parle que de 75 % d’économie en moyenne. L’écart entre ces deux chiffres décide si votre facture va fondre ou simplement maigrir. Le modèle est sorti le 7 octobre 2026, c’est le plus petit et le plus rapide de la gamme, et il vise un rôle précis : faire le travail répétitif à votre place, pendant qu’un modèle plus grand réfléchit.
Si vous déployez des assistants, du tri de documents ou des agents qui enchaînent des centaines d’appels par jour, ce lancement vous concerne directement. Si vous cherchez le meilleur cerveau disponible, il ne vous concerne pas, et Anthropic le dit elle-même. Voyons ce que valent vraiment les chiffres.
En bref : Claude Haiku 5.5 est disponible depuis le 7 octobre 2026 sur l’API Claude, Amazon Bedrock, Google Cloud et Microsoft Foundry. Il coûte 0,10 dollar en entrée et 0,50 dollar en sortie par million de tokens jusqu’à 100 000 tokens de prompt, avec une fenêtre de contexte de 1 million de tokens. Son nouveau tokenizer compte environ 30 % de tokens en plus pour le même texte, ce qui ramène la baisse réelle entre 35 % et 87 % selon la taille de vos prompts. Sonnet 5.5 reste devant sur tous les benchmarks publiés.
Claude Haiku 5.5 : ce qu’Anthropic a lancé le 7 octobre
Haiku 5.5 est le modèle économique de la famille 5.5, celle de Sonnet 5.5 et d’Opus 5.5. Il accepte du texte et des images, répond en texte, gère un contexte d’un million de tokens et peut produire jusqu’à 128 000 tokens en sortie. Sa date de connaissance s’arrête en juin 2026. Nouveauté pour un Haiku : un réglage d’effort de réflexion, le modèle décidant lui-même combien de temps raisonner (le niveau moyen est le défaut). Haiku 4.5 se contentait d’un budget de réflexion fixe.
Côté disponibilité, il est accessible sur l’API Claude (identifiant claude-haiku-5-5), Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS. La documentation indique qu’Anthropic ne le retirera pas avant le 7 octobre 2027, une garantie utile si vous construisez un produit dessus. Je n’ai trouvé aucune mention d’une disponibilité différente selon les pays : la page officielle renvoie vers une page de pays pris en charge, que je vous conseille de consulter si vous êtes en Afrique francophone, au Maghreb ou en Suisse avant de planifier un déploiement.
Anthropic le positionne comme un exécutant. L’usage type : des sous-agents qui extraient une ligne d’un rapport financier, classent des tickets ou résument des documents en grand volume, pendant qu’un Sonnet ou un Opus pilote l’ensemble. Le fournisseur cite des tests de clients sur du questions-réponses documentaire à très forte volumétrie (environ 8 millions d’appels par semaine pour l’un d’eux) et sur de l’assistance client en direct.
Prix de Claude Haiku 5.5 : 90 % annoncés, 75 % en moyenne, 35 % dans le pire cas
Le tarif de base est spectaculaire. Haiku 4.5 coûtait 1 dollar en entrée et 5 dollars en sortie par million de tokens. Haiku 5.5 descend à 0,10 et 0,50 dollar pour les prompts jusqu’à 100 000 tokens, puis passe à 0,50 et 2,50 dollars au-delà. Le traitement par lots (batch) offre encore 50 % de remise, et la lecture depuis le cache tombe à 0,01 dollar.
| Par million de tokens | Haiku 5.5 (jusqu’à 100 000) | Haiku 5.5 (au-delà) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| Entrée | 0,10 $ | 0,50 $ | 1,00 $ | 2,00 $ |
| Sortie | 0,50 $ | 2,50 $ | 5,00 $ | 10,00 $ |
| Lecture du cache | 0,01 $ | 0,05 $ | 0,10 $ | 0,10 $ |
Voici pourquoi la baisse n’est pas de 90 %. Le nouveau tokenizer découpe le même texte en environ 30 % de tokens supplémentaires par rapport à Haiku 4.5. Reprenons le calcul (c’est le mien, pas celui d’Anthropic) : un texte qui valait 1 million de tokens sur Haiku 4.5 en vaut 1,3 million sur Haiku 5.5, soit 0,13 dollar en entrée au lieu de 1 dollar. Pour un prompt court, l’économie réelle tourne donc autour de 87 %. Pour un prompt de plus de 100 000 tokens, 1,3 million de tokens à 0,50 dollar font 0,65 dollar contre 1 dollar : seulement 35 % d’économie.
Un exemple pour fixer les idées. Une charge mensuelle de 10 millions de tokens en entrée et 2 millions en sortie coûtait 20 dollars sur Haiku 4.5. Sur Haiku 5.5 avec des prompts courts, elle revient à environ 2,60 dollars. Avec des prompts longs, à environ 13 dollars. Anthropic arrive à 75 % de réduction moyenne en estimant qu’environ 90 % des requêtes de Haiku 4.5 restaient sous les 100 000 tokens. Si vos usages sont de longs dossiers, vous êtes dans l’autre moitié du tableau.
Dernière précision pour les lecteurs hors des États-Unis : tout est facturé en dollars. Je n’ai pas trouvé de grille en euros, en francs suisses ou en dollars canadiens, et la TVA ou la taxe locale s’ajoute selon votre pays. Passer par Bedrock, Google Cloud ou Microsoft Foundry peut aussi changer la facture finale et la région d’hébergement, à vérifier chez votre fournisseur.
Les benchmarks : de gros progrès, mais Sonnet 5.5 reste devant partout
Les progrès par rapport à Haiku 4.5 sont énormes : sur OSWorld 2.1, test de pilotage d’un ordinateur, le score passe de 15,7 % à 72,4 %. Sur Terminal-Bench 4.0, test de travail en ligne de commande, de 0 % à 39,2 %. Mais regardons la colonne de droite, celle que les communiqués aiment oublier : Sonnet 5.5 bat Haiku 5.5 sur chaque ligne publiée.
| Benchmark | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 | GPT-6 Luna |
|---|---|---|---|---|
| OSWorld 2.1 (sous-ensemble hors ligne) | 72,4 % | 15,7 % | 83,9 % | 48,9 % |
| Terminal-Bench 4.0 | 39,2 % | 0,0 % | 70,6 % | 16,4 % |
| FrontierCode 1.1 (Main) | 46,4 % | non communiqué | 52,1 % | 42,4 % |
| Humanity’s Last Exam (sans outils) | 45,9 % | 10,2 % | 56,9 % | non communiqué |
| GDPval-AA v2.1 (Elo) | 1 620 | 735 | 1 840 | 1 437 |
L’écart le plus parlant concerne le travail en terminal : 39,2 % contre 70,6 %. Haiku 5.5 réussit environ quatre tâches sur dix là où Sonnet en réussit sept. Pour un agent de programmation autonome, c’est une différence de nature, pas de degré, et Anthropic recommande d’ailleurs Sonnet 5.5 ou Opus 5.5 pour les chantiers de code complexes. Deux autres réserves : tous ces chiffres viennent du fournisseur, et le choix des tests lui appartient. Aucune comparaison avec GPT-6.1 Sol ou avec un modèle Gemini n’est publiée dans le lancement.
Face à GPT-6 Luna : même prix de départ, pas le même profil
Le concurrent naturel est GPT-6 Luna, le palier économique d’OpenAI, que nous avons détaillé dans notre article sur GPT-6.1 Sol et Dots. Son tarif d’API est identique à celui de Haiku 5.5 sur les prompts courts : 0,10 dollar en entrée, 0,50 dollar en sortie. Sur les quatre tests du tableau où les deux sont comparés, Haiku 5.5 devance Luna : 72,4 % contre 48,9 % sur OSWorld, 39,2 % contre 16,4 % sur Terminal-Bench, 46,4 % contre 42,4 % sur FrontierCode, et 1 620 contre 1 437 en Elo sur GDPval-AA.
Prudence tout de même : c’est Anthropic qui a sélectionné ces comparaisons. L’écart sur FrontierCode (4 points) est mince, et la structure tarifaire diffère au-delà d’un certain volume de prompt, ce qui peut faire pencher la balance pour vos longs documents. Le seul test fiable reste le vôtre : prenez 200 de vos vrais cas, passez-les dans les deux modèles, comparez la qualité et le coût par tâche, pas le coût par token.
Migrer depuis Haiku 4.5 : deux pièges à connaître
Le premier piège est budgétaire : le tokenizer change, donc vos estimations de volume doivent être refaites avec environ 30 % de tokens en plus. Un prompt qui passait juste sous la barre des 100 000 tokens peut désormais la franchir et basculer au tarif supérieur, cinq fois plus cher. Surveillez vos longs contextes.
Le second est technique : si votre code envoie des valeurs personnalisées de temperature, top_p ou top_k, l’API renvoie une erreur 400. Le guide de migration d’Anthropic liste d’autres changements bloquants, à lire en entier avant de basculer la production. Prévoyez une phase de test sur un échantillon de trafic plutôt qu’un remplacement sec d’identifiant de modèle.
Faut-il adopter Claude Haiku 5.5 ? Mon avis
Oui, pour les tâches répétitives et volumineuses : classification, extraction, routage de demandes, résumés, réponses sur des bases documentaires, sous-agents dans une architecture à plusieurs modèles. À ce prix, des cas d’usage qui ne passaient pas le seuil de rentabilité le franchissent. Un exemple raconté par DataCamp est parlant : sur 24 factures fournisseurs à contrôler, Haiku 5.5 et Haiku 4.5 ont obtenu 24 sur 24, pour 0,0098 dollar contre 0,25 dollar. L’auteur précise toutefois que son test, sur un seul type de tâche, n’était pas assez difficile pour départager les modèles.
Non, si votre besoin est le code autonome de longue haleine, le raisonnement complexe ou la rédaction soignée. Pour ces cas, restez sur Sonnet 5.5 ou montez en gamme, et relisez notre guide quel modèle IA pour quel usage. Pour situer les modèles haut de gamme d’Anthropic, notre article sur Claude Fable 5 reste la référence.
Mon pronostic : le vrai gagnant de ce lancement est l’architecture à deux étages, un grand modèle qui planifie et des Haiku qui exécutent. C’est là que l’économie est la plus massive. Une question ou un retour d’expérience sur votre migration ? Écrivez-nous à contact@leproia.com.
Questions fréquentes
Qu’est-ce que Claude Haiku 5.5 ?
C’est le modèle le plus petit, le plus rapide et le moins cher de la famille Claude 5.5, lancé le 7 octobre 2026. Il propose un contexte d’un million de tokens, jusqu’à 128 000 tokens en sortie et un réglage d’effort de réflexion.
Combien coûte Claude Haiku 5.5 ?
0,10 dollar par million de tokens en entrée et 0,50 dollar en sortie pour les prompts jusqu’à 100 000 tokens, puis 0,50 et 2,50 dollars au-delà. Le traitement par lots offre 50 % de remise. Les prix sont en dollars américains.
Haiku 5.5 est-il vraiment 90 % moins cher que Haiku 4.5 ?
Seulement sur le tarif affiché pour les prompts courts. Le nouveau tokenizer compte environ 30 % de tokens en plus, et le tarif augmente au-delà de 100 000 tokens. Anthropic annonce 75 % d’économie en moyenne, et notre calcul donne entre 35 % et 87 % selon la taille des prompts.
Haiku 5.5 est-il meilleur que Sonnet 5.5 ?
Non. Sonnet 5.5 le devance sur tous les benchmarks publiés, par exemple 70,6 % contre 39,2 % sur Terminal-Bench 4.0. Haiku 5.5 vise les tâches volumineuses et rapides, ou le rôle de sous-agent.
Haiku 5.5 bat-il GPT-6 Luna ?
Sur les quatre tests chiffrés comparés par Anthropic, oui, par exemple 72,4 % contre 48,9 % sur OSWorld 2.1. Ces chiffres viennent du fournisseur et ne sont pas vérifiés indépendamment. Les deux modèles partagent le même tarif de départ de 0,10 et 0,50 dollar.
Où utiliser Claude Haiku 5.5 ?
Sur l’API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform on AWS. Anthropic s’engage à ne pas le retirer avant le 7 octobre 2027.
Sources
Informations vérifiées le 8 octobre 2026 : Anthropic, page officielle de Claude Haiku 5.5 ; documentation Claude Platform, Haiku 5.5 ; MarkTechPost ; DataCamp.