
Le coût de l'IA à fort volume vient encore de baisser. Le 7 octobre 2026, Anthropic a lancé Claude Haiku 5.5, présenté par l'entreprise comme son modèle petit « le plus rapide, le moins cher et le plus capable » à ce jour. Sur les tâches à faible contexte, le tarif chute d'environ 90 % par rapport à Haiku 4.5. Pour une PME qui classe des emails, résume des documents ou fait tourner un chatbot de support toute la journée, cette baisse change directement l'équation budgétaire de l'automatisation.
En bref
- Anthropic a lancé Claude Haiku 5.5 le 7 octobre 2026, deux semaines après Claude Sonnet 5.5.
- Pour les requêtes de moins de 100 000 tokens de contexte, le tarif passe à 0,10 $ par million de tokens en entrée et 0,50 $ en sortie, contre 1 $ et 5 $ pour Haiku 4.5, soit environ 90 % de baisse sur ce palier.
- En tenant compte de l'usage réel mélangé, Anthropic annonce une économie moyenne de 75 % par rapport à Haiku 4.5.
- Sur le test de navigation et d'usage d'ordinateur OSWorld 2.1, le score grimpe de 15,7 % à 72,4 % d'une génération à l'autre.
- C'est le premier modèle Haiku à proposer un curseur d'effort, pour arbitrer soi-même entre coût et intelligence selon la tâche.
Un modèle pensé pour le volume, pas pour la prouesse
Claude Haiku 5.5 occupe le bas de la gamme Claude, sous Sonnet 5.5 et Opus 5.5. Sa mission n'est pas de rivaliser sur le raisonnement le plus complexe, mais de traiter un grand nombre de tâches simples au coût le plus bas possible : classification d'emails ou de tickets, résumés courts, requêtes dans une base de données, premier niveau de support client, ou encore sous-tâches déléguées par un agent IA plus gros.
Anthropic recommande explicitement ce modèle pour les scénarios à haut volume et faible complexité par tâche, c'est-à-dire exactement le type de travail qu'une PME automatise en premier : trier une boîte mail commerciale, pré-qualifier des leads entrants, ou générer des comptes-rendus de réunion standardisés.
Définition rapide : le curseur d'effort
Claude Haiku 5.5 est le premier modèle Haiku à proposer plusieurs niveaux d'effort réglables. L'entreprise peut demander une réponse rapide et économique pour une tâche simple, ou un niveau de réflexion plus poussé (donc plus coûteux) pour un cas plus délicat, sans changer de modèle.
Une baisse de prix qui se mesure par palier
Le point le plus concret de l'annonce concerne la grille tarifaire. Elle fonctionne par palier, selon la longueur du contexte envoyé au modèle.
| Palier | Claude Haiku 4.5 | Claude Haiku 5.5 |
|---|---|---|
| Entrée (jusqu'à 100 000 tokens) | 1 $ / million de tokens | 0,10 $ / million de tokens |
| Sortie (jusqu'à 100 000 tokens) | 5 $ / million de tokens | 0,50 $ / million de tokens |
| Entrée (au-delà de 100 000 tokens) | 1 $ / million de tokens | 0,50 $ / million de tokens |
| Sortie (au-delà de 100 000 tokens) | 5 $ / million de tokens | 2,50 $ / million de tokens |
Source : Anthropic, annonce de lancement Claude Haiku 5.5, 7 octobre 2026 ; chiffres relayés et recoupés par les médias spécialisés The New Stack et PPC Land.
Anthropic précise que le palier le moins cher couvre environ 90 % du trafic observé sur l'ancien modèle Haiku 4.5, c'est-à-dire que la grande majorité des usages réels profitent directement de la baisse maximale, sans configuration particulière à faire.
Des progrès nets sur les tâches d'agent et de navigation
Un modèle moins cher n'a d'intérêt que s'il reste capable. Anthropic publie plusieurs résultats de tests comparant Haiku 5.5 à Haiku 4.5, et à titre de repère, au modèle concurrent GPT-6 Luna d'OpenAI.
Sur OSWorld 2.1, un test qui évalue la capacité d'un agent IA à utiliser un ordinateur comme le ferait un humain (naviguer, cliquer, remplir des champs), le score bondit de 15,7 % à 72,4 %. Sur Terminal-Bench 4.0, un test d'agentivité technique, Haiku 5.5 atteint 39,2 %, devant GPT-6 Luna selon Anthropic, mais nettement derrière Sonnet 5.5 (70,6 %), ce qui confirme sa place de modèle d'appoint plutôt que de modèle de référence pour les tâches les plus exigeantes.
Claude Haiku 5.5
Claude Sonnet 5.5
Pourquoi cette baisse compte pour une PME
Pour un dirigeant de PME, l'enjeu n'est pas le benchmark en lui-même, mais ce qu'il permet financièrement. Un modèle 90 % moins cher sur les tâches courtes rend rentables des automatisations qui ne l'étaient pas il y a encore quelques mois : un chatbot qui répond à des centaines de questions par jour, un classement automatique de factures, ou un tri de candidatures en recrutement.
La vigilance reste la même que pour tout changement de modèle : tester avant de généraliser. Un modèle moins cher qui produit des réponses de moins bonne qualité sur un cas d'usage précis peut coûter plus cher en corrections humaines que l'ancien modèle, même avec un tarif catalogue plus bas. L'arbitrage coût/qualité se fait toujours à l'échelle d'une tâche réelle, pas d'un prix affiché.
Identifier les tâches à fort volume
Tester Haiku 5.5 sur un échantillon
Généraliser avec un garde-fou
FAQ
Qu'est-ce que Claude Haiku 5.5 ?
Claude Haiku 5.5 est le modèle d'intelligence artificielle le plus petit et le moins cher de la gamme Claude d'Anthropic, lancé le 7 octobre 2026. Il est conçu pour des tâches simples traitées en très grand volume : classification, résumés, support client, requêtes de données.
Combien coûte Claude Haiku 5.5 ?
Pour les requêtes dont le contexte ne dépasse pas 100 000 tokens, le tarif est de 0,10 $ par million de tokens en entrée et 0,50 $ en sortie. Au-delà de ce seuil, les tarifs passent à 0,50 $ et 2,50 $. Ces chiffres représentent une baisse d'environ 90 % par rapport à Haiku 4.5 sur le premier palier.
Claude Haiku 5.5 peut-il remplacer un modèle plus puissant comme Sonnet 5.5 ?
Non, pas pour toutes les tâches. Haiku 5.5 reste en retrait sur les benchmarks de raisonnement complexe et d'agentivité technique poussée (39,2 % contre 70,6 % pour Sonnet 5.5 sur Terminal-Bench 4.0). Il convient aux tâches simples à fort volume, pas aux missions qui demandent un raisonnement approfondi.
Où est disponible Claude Haiku 5.5 ?
Le modèle est accessible sur la plateforme Claude d'Anthropic ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure, sous l'identifiant technique claude-haiku-5-5.
Automatiser avec le bon modèle au bon coût est désormais un vrai sujet d'arbitrage pour les PME. Pour aller plus loin, consultez notre guide pour choisir son modèle d'IA ou explorez l'ensemble de nos ressources IA pour dirigeants.


