Haiku 5.5 rend les petits modèles d’IA bien plus compétitifs

Anthropic lance Claude Haiku 5.5 avec des tarifs nettement revus à la baisse et des gains marqués sur les benchmarks d’usage agentique. Le modèle est disponible sur Claude Platform, AWS, Google Cloud et Azure.

Anthropic a lancé le 7 octobre 2026 Claude Haiku 5.5, la nouvelle version de son plus petit modèle, avec une baisse de prix spectaculaire et des gains notables sur les tâches d’agent et de bureautique. Le modèle vise les usages à fort volume, comme les résumés, les requêtes en base de données, la classification et le support client en direct. Dans un marché où chaque centime compte, c’est le genre d’annonce qui fait lever un sourcil chez les équipes produit… et fermer un peu plus fort le portefeuille chez les concurrents.

Un petit modèle pensé pour les tâches qui tournent en boucle

Haiku 5.5 est présenté comme le modèle « le plus rapide et le plus efficace » d’Anthropic dans sa catégorie, avec une précision utile : il est surtout calibré pour des tâches étroites et répétitives, pas pour remplacer les gros modèles sur les problèmes complexes. Anthropic le destine notamment à la compaction, aux résumés, aux requêtes de base de données, au classement, au support client en direct et à l’usage navigateur. Le modèle est accessible sur la Claude Platform, AWS, Google Cloud et Microsoft Azure, sous le nom claude-haiku-5-5.

La nouveauté la plus concrète tient au tarif. Pour des requêtes de moins de 100 000 tokens, Haiku 5.5 est facturé 0,10 dollar par million de tokens en entrée et 0,50 dollar en sortie, contre 1 dollar et 5 dollars pour Haiku 4.5. Anthropic dit que cela représente en moyenne une baisse d’environ 75 % du coût d’usage, avec jusqu’à 90 % de réduction sur les requêtes les plus courantes. Au-delà de 100 000 tokens, les prix montent à 0,50 dollar en entrée et 2,50 dollars en sortie. Le modèle ajoute aussi un réglage d’effort, une première pour la gamme Haiku, afin d’arbitrer entre coût et qualité.

Des gains nets sur les benchmarks, surtout quand l’agent doit agir

Les chiffres publiés par Anthropic montrent une progression franche face à Haiku 4.5. Sur GDPval-AA v2.1, un test de tâches de travail, Haiku 5.5 atteint 1 620 points contre 735 pour son prédécesseur. Sur OSWorld 2.1, qui évalue l’usage d’un ordinateur, il grimpe à 72,4 % sur le sous-ensemble hors ligne, contre 15,7 %. Et sur Terminal-Bench 4.0, centré sur les tâches agentiques en ligne de commande, le modèle passe à 39,2 % là où Haiku 4.5 était à 0 %.

Le tableau fourni par Anthropic place aussi Haiku 5.5 devant GPT-6 Luna d’OpenAI sur plusieurs mesures, dont GDPval-AA v2.1 et Terminal-Bench 4.0. En revanche, Sonnet 5.5 reste au-dessus sur l’ensemble des tests. Autrement dit, Haiku 5.5 progresse assez pour devenir un vrai modèle de production sur les tâches rapides, mais pas au point de faire de l’ombre au reste de la gamme. La hiérarchie interne tient encore debout.

La guerre des prix s’intensifie chez les modèles compacts

Anthropic ne parle pas seulement de performance. L’entreprise baisse aussi de moitié le prix des cache reads de Sonnet 5.5, de 0,20 dollar à 0,10 dollar par million de tokens, avec un impact annoncé d’environ 20 % de baisse sur la plupart des tâches agentiques. En parallèle, les abonnés Max et Team reçoivent des crédits API mensuels, jusqu’à 100 dollars pour Max 5x, 200 dollars pour Max 20x et 500 dollars mutualisés pour les équipes.

Cette séquence ressemble à une réponse directe à l’accélération des prix côté concurrence, notamment sur les modèles compacts. Haiku 5.5 n’est pas seulement un lancement technique ; c’est aussi un signal sur la marge de manœuvre restante dans les offres d’IA générative. Les tarifs baissent, les benchmarks montent, et les modèles « petits » deviennent soudain bien plus sérieux pour les entreprises qui doivent tenir un budget.

Points clés

  • Lancement le 7 octobre 2026 par Anthropic.
  • Haiku 5.5 vise les tâches à fort volume.
  • Jusqu’à 90 % de baisse tarifaire sur certains usages.
  • OSWorld 2.1 : 72,4 % contre 15,7 %.
  • Terminal-Bench 4.0 : 39,2 % contre 0 %.
  • Sonnet 5.5 voit son cache read divisé par deux.
  • Anthropic : Claude Platform, AWS, Google Cloud, Azure.

En chiffres

  • 75 % — baisse moyenne annoncée du coût d’usage de Haiku 5.5.
  • 0,10 $ / 0,50 $ — prix entrée/sortie par million de tokens sous 100 000 tokens.
  • 1 620 points — score sur GDPval-AA v2.1, contre 735 pour Haiku 4.5.
  • 72,4 % — score sur OSWorld 2.1 offline, contre 15,7 %.
  • 39,2 % — score sur Terminal-Bench 4.0, contre 0 %.

À lire