Claude Haiku 5.5 : 90 % moins cher, mais gourmand en tokens
Anthropic lance Haiku 5.5, son petit modèle le moins cher, avec un réglage de l'effort inédit chez Haiku. Le tarif baisse de 90 % sur les prompts courts, mais la consommation de tokens pèse sur le coût par tâche.
Anthropic a lancé Claude Haiku 5.5, présenté comme son modèle de petite taille le plus rapide, le moins cher et le plus capable. C'est le premier Haiku doté d'un réglage d'effort, qui permet d'arbitrer entre coût et intelligence. L'entreprise revendique un coût d'usage inférieur d'environ 75 % en moyenne à celui de Haiku 4.5. Un premier test indépendant montre toutefois que, à effort maximal, le modèle consomme beaucoup de tokens de sortie par tâche.
Un tarif divisé par dix, sous conditions
Pour les prompts jusqu'à 100 000 tokens, Haiku 5.5 coûte 0,10 dollar par million de tokens en entrée et 0,50 dollar en sortie, selon Storyboard18. Au-delà, les tarifs sont multipliés par cinq : 0,50 et 2,50 dollars. Haiku 4.5 facturait 1 dollar l'entrée et 5 dollars la sortie, d'après Implicator.ai, qui note que les tarifs courts sont identiques à ceux de GPT-6 Luna, d'OpenAI.
Dans son annonce, Anthropic précise que la baisse est de 90 % pour les requêtes courtes et de 50 % pour les longues. Environ 90 % des requêtes adressées à Haiku 4.5 relevaient de la première catégorie. L'économie moyenne tombe à 75 % parce que le calcul intègre aussi le nouveau tokenizer, qui compte davantage de tokens par tâche. Implicator.ai chiffre cet écart à environ 30 % pour un même texte.
La fenêtre de contexte passe de 200 000 à un million de tokens. Implicator.ai relève qu'un prompt proche du seuil peut basculer dans la tranche la plus chère après migration, et que le guide de migration recense des changements non rétrocompatibles.
Effort réglable, résultats contrastés
Sur le papier, les progrès sont nets. Selon Storyboard18, Haiku 5.5 obtient 72,4 % sur le sous-ensemble hors ligne d'OSWorld 2.1, contre 15,7 % pour Haiku 4.5, et 39,2 % sur Terminal-Bench 4.0, qui mesure le codage agentique. Selon Anthropic, Sonnet 5.5 et Opus 5.5 restent de meilleurs choix pour les tâches complexes de codage agentique, Haiku étant destiné à des tâches circonscrites comme la compaction, le résumé ou le travail en sous-agent.
Artificial Analysis, seul testeur indépendant à ce stade selon Implicator.ai, place le modèle à 43 sur son indice d'intelligence à effort maximal, devant GPT-6 Luna (38). Sur Terminal-Bench 4.0, il mesure 33 %, contre 13 % pour Luna. Artificial Analysis indique aussi une vitesse de sortie de 244 tokens par seconde en configuration maximale.
Mais le prix par token ne fait pas le prix par tâche. Selon Implicator.ai, à effort maximal, Haiku 5.5 a consommé environ 162 000 tokens de sortie par tâche, contre environ 50 000 pour Luna, au même tarif de sortie. À effort élevé, il obtient 38 avec environ 55 000 tokens, soit le score de Luna à son maximum. Artificial Analysis n'intègre pas encore la tarification par paliers dans ses coûts par tâche.
Autre point faible : 35 % sur AutomationBench-AA, contre 53 à 60 % pour des concurrents. Artificial Analysis attribue ce résultat à des refus excessifs liés aux mesures de sécurité en test préalable ; Anthropic prépare un correctif et le test sera relancé. Sur la factualité, le modèle est moins exact (36 %) que Luna (44 %), mais hallucine moins (40 % contre 77 %), car il admet plus volontiers ne pas savoir.
Sécurité et disponibilité
Anthropic affirme que Haiku 5.5 progresse sur presque toutes ses évaluations d'alignement. Ses garde-fous en cybersécurité sont plus restrictifs que ceux de Haiku 4.5, mais un peu moins que ceux appliqués à d'autres modèles récents ; les tests d'intrusion restent bloqués. En biologie, ils sont identiques à ceux de Sonnet 5, Sonnet 5.5 et Opus 5.
Le modèle est disponible sur la Claude Platform (identifiant claude-haiku-5-5), AWS, Google Cloud et Microsoft Azure, ainsi que sur GitHub Copilot selon Implicator.ai. Les SDK Python et TypeScript gagnent un support bêta de l'usage d'ordinateur et de navigateur. Parmi les premiers retours clients cités par Storyboard18, Asana fait état d'une latence réduite de plus de 30 %, un témoignage fourni par Anthropic.
Sonnet moins cher, crédits API pour Max et Team
Anthropic réduit de moitié le prix des lectures de cache de Sonnet 5.5, de 0,20 à 0,10 dollar par million de tokens, soit environ 20 % d'économie sur la plupart des tâches agentiques.
Les abonnés Max et Team reçoivent aussi un crédit mensuel pour la Claude Platform : 100 dollars pour Max 5x, 200 pour Max 20x et jusqu'à 500 dollars mutualisés pour Team. Selon le centre d'aide de Claude, il faut sept jours d'abonnement, les crédits ne sont pas reportés d'un cycle à l'autre, et ils ne couvrent ni Claude Code interactif ni les usages via Bedrock, Vertex AI ou Foundry. Les abonnés Pro en sont exclus. Le déploiement s'étale sur quelques jours.
Sources
- Introducing Claude Haiku 5.5 — Anthropic
- Monthly API credits for Max and Team plans | Claude Help Center — Claude
- Anthropic launches Claude Haiku 5.5 with 90% lower pricing ahead of planned IPO — Advertising, Marketing …
- Claude Haiku 5.5 Models - Intelligence, Performance & Price Comparison | Artificial Analysis — Artificial Analysis
- Claude Haiku 5.5 Matches GPT-6 Luna Price, Uses More Tokens — Implicator.ai