Claude Opus 5.5 réduit le coût des raisonnements sans tout accélérer
Anthropic avance des gains de coût et de vitesse avec Claude Opus 5.5. Un test indépendant sur des problèmes de raisonnement montre des économies réelles, mais un progrès plus modeste sur la rapidité.
Anthropic a lancé Claude Opus 5.5, un modèle de langage haut de gamme facturé 40% moins cher que Opus 5 sur ses tarifs API, avec une promesse de vitesse supérieure. Un test indépendant publié par Jessica Wachtel montre que ces gains existent sur des tâches de raisonnement, mais qu’ils restent plus mesurés que la communication d’Anthropic ne le suggère. Dans un marché où chaque token compte, la différence finit vite par se voir sur la facture.
Des économies réelles, mais pas les mêmes selon les tâches
Sur trois exercices de raisonnement, le constat est nuancé. Opus 5.5 et Opus 5 ont résolu la grille logique et le jeu de pierres avec les mêmes réponses, puis ont échoué tous les deux sur un problème d’ordonnancement plus difficile. Là où le nouveau modèle marque des points, c’est sur le coût et le temps de calcul.
Pour la grille logique, Opus 5.5 a rendu une réponse correcte en 65 secondes, contre 108 secondes pour Opus 5, avec 7 573 jetons de sortie contre 10 621. Sur le jeu de pierres, l’écart devient plus net encore : 215 secondes et 28 740 jetons de sortie pour Opus 5.5, contre 624 secondes et 74 981 jetons pour Opus 5. Le résultat est le même, mais la note baisse sensiblement.
Sur le plan tarifaire, Anthropic affiche un prix API de 4 dollars par million de jetons en entrée et 20 dollars par million en sortie pour Opus 5.5, contre 5 et 25 dollars pour Opus 5. La baisse ne suffit pas à expliquer à elle seule les économies observées. Une part importante vient aussi du fait que le nouveau modèle consomme moins de jetons pour parvenir à une réponse. C’est banal sur le papier, mais très concret quand on paie la machine à réfléchir à la minute.
La vitesse progresse, sans atteindre la promesse marketing
Jessica Wachtel note qu’Opus 5.5 a écrit 103,4 jetons par seconde sur l’ensemble des appels testés, contre 93,1 pour Opus 5. Cela représente environ 11% de mieux, donc moins que les 30% de vitesse mis en avant par Anthropic. L’écart reste utile, toutefois il ne transforme pas l’expérience en turbo illimité.
La limite apparaît surtout sur les tâches qui poussent le modèle à raisonner longtemps. Dans l’épreuve d’ordonnancement, les deux versions ont vidé leur budget de sortie sans produire de réponse utile. Avec un plafond de 48 000 jetons, elles ont tourné à vide ; avec 128 000 jetons, Opus 5.5 a fini par rendre une réponse classée en refusal, que l’autrice juge probablement déclenchée par erreur par le filtre de sécurité. Cette partie du test rappelle un point simple : un modèle peut être moins cher et rester bloqué quand même.
Anthropic présente pourtant Opus 5.5 comme un modèle au niveau de Claude Fable 5.1 et plus rapide qu’Opus 5. Les mesures rapportées ici confirment la baisse des coûts, mais pas au degré promis pour la vitesse. Selon le test publié, le gain réel vient surtout de la réduction des jetons produits, pas d’un bond spectaculaire de performance.
Ce que cela change pour les équipes qui paient à la consommation
Pour les équipes qui utilisent Opus 5 aujourd’hui, le signal est assez clair : Opus 5.5 peut faire la même chose pour moins cher, à condition d’accepter que certains problèmes restent longs à résoudre. Sur les raisonnements qui aboutissent, le nouveau modèle a réduit la dépense de 43% sur la grille logique et de 69% sur le jeu de pierres, selon le test de Jessica Wachtel.
En revanche, sur les tâches combinatoires ou de comptage, la bonne réponse n’est pas forcément “faire mieux réfléchir” le modèle. Mieux vaut souvent lui donner un outil d’exécution de code. Là encore, l’IA adore promettre qu’elle va tout faire seule ; les feuilles de calcul, elles, continuent de rendre service.
Le bilan publié par The New Stack ne contredit donc pas Anthropic, mais le replace à sa juste taille. Opus 5.5 est plus économique, un peu plus rapide, et efficace sur certains raisonnements. Il n’efface pas les limites des modèles de langue sur les problèmes qui demandent de compter, d’explorer tout un espace de possibilités ou de tenir longtemps sans s’égarer.
En chiffres
- 40% — baisse de prix annoncée par Anthropic sur Opus 5.5, par rapport à Opus 5.
- 30% — vitesse de génération revendiquée par Anthropic pour Opus 5.5 [à vérifier].
- 11% — gain de vitesse mesuré par Jessica Wachtel sur l’ensemble des appels.
- 69% — baisse de coût observée sur le jeu de pierres, test indépendant.
- 500 — taille maximale de l’échantillon étudié pour le jeu de pierres.