
Le fait
Le 7 octobre 2026, Anthropic publie Claude Haiku 5.5, troisième modèle de la génération 5.5 après Opus 5.5 (22 septembre) et Sonnet 5.5 (28 septembre). L’éditeur le présente comme « le petit modèle le moins cher, le plus rapide et le plus capable » qu’il ait jamais sorti. Il est disponible immédiatement sur la plateforme Claude (identifiant claude-haiku-5-5), ainsi que chez AWS, Google Cloud et Microsoft Azure.
À quoi il sert
Haiku 5.5 vise les tâches volumineuses et sensibles au coût : résumés, compactage de contexte (réduire une longue conversation pour qu’elle tienne dans la mémoire du modèle), requêtes en base de données, classification. Anthropic le recommande aussi comme sous-agent : dans un projet de code, Opus 5.5 ou Sonnet 5.5 pilote et délègue à Haiku les petites tâches. C’est enfin son modèle le plus rapide en vitesse standard, d’où un usage conseillé pour le support client en direct et la navigation web automatisée.
Nouveauté : c’est le premier Haiku doté d’un niveau d’effort réglable, pour arbitrer entre coût et qualité de raisonnement.
Le prix, argument principal
Pour les requêtes jusqu’à 100 000 tokens, qui représentaient environ 90 % des appels à Haiku 4.5, Haiku 5.5 coûte 0,10 dollar par million de tokens en entrée et 0,50 dollar en sortie, contre 1 et 5 dollars pour Haiku 4.5 : 90 % de moins. Au-delà de 100 000 tokens, la baisse est de 50 %. Comme le nouveau tokeniseur consomme un peu plus de tokens par tâche, Anthropic chiffre l’économie moyenne à environ 75 %.
Ces tarifs sont exactement ceux de GPT-6 Luna, le modèle économique d’OpenAI, note SiliconANGLE.
Les performances revendiquées
Sur les tests publiés par Anthropic (donc à confirmer par des évaluations indépendantes), Haiku 5.5 devance Luna partout où les deux sont mesurés :
- OSWorld 2.1 (utiliser un vrai ordinateur sur des tâches longues) : 72,4 % contre 48,9 % pour Luna et 15,7 % pour Haiku 4.5 ;
- Terminal-Bench 4.0 (code agentique en ligne de commande) : 39,2 % contre 16,4 % pour Luna ;
- Humanity’s Last Exam (questions de niveau expert), sans outils : 45,9 % contre 10,2 % pour Haiku 4.5.
Anthropic reconnaît que pour le code agentique complexe, Sonnet 5.5 (70,6 % sur Terminal-Bench 4.0) et Opus 5.5 restent les bons choix. Côté clients testeurs, Asana mesure une latence en baisse de plus de 30 % et une inférence jusqu’à 2,5 fois plus rapide par tour d’agent ; HubSpot obtient 92,8 % sur sa suite de tâches CRM, son meilleur score pour un petit modèle.
Sécurité et garde-fous
Anthropic indique beaucoup moins de comportements désalignés (non conformes aux intentions des concepteurs) qu’avec Haiku 4.5. En cybersécurité, les garde-fous autorisent davantage de travail défensif que ceux de Sonnet 5.5, mais bloquent toujours les tests d’intrusion et techniques d’attaque. Les organisations qui ont besoin d’un accès élargi peuvent candidater au Cyber Verification Program, élargi la veille, le 6 octobre.
Les annonces qui accompagnent le lancement
- Sonnet 5.5 : le prix des lectures en cache (le texte déjà traité et réutilisé d’une requête à l’autre) passe de 0,20 à 0,10 dollar par million de tokens, soit environ 20 % d’économie sur la plupart des travaux agentiques.
- Crédits API mensuels pour les abonnés : 100 dollars pour Max 5x, 200 dollars pour Max 20x, jusqu’à 500 dollars mutualisés pour les comptes Team.
- Les SDK Python et TypeScript de Claude prennent en charge, en bêta, l’utilisation d’ordinateur et la navigation web.
Notre lecture
La bataille des petits modèles se joue désormais au centime près, et Anthropic aligne ses prix sur OpenAI tout en revendiquant de meilleurs scores. Pour une entreprise, le cas d’usage le plus rentable est l’architecture en équipe : un grand modèle qui réfléchit, des Haiku qui exécutent à la chaîne. C’est là que la baisse de 75 % pèse vraiment sur la facture.