Claude Opus 5.5 baisse ses prix et resserre le contrôle des agents

Anthropic lance Claude Opus 5.5, moins cher et plus rapide que Claude Opus 5. Le modèle peut toutefois être redirigé vers des versions plus anciennes selon les garde-fous de sécurité.

Anthropic a lancé, le 22 septembre 2026, Claude Opus 5.5, un modèle d’IA orienté développement et tâches agentiques qui coûte moins cher à l’usage tout en promettant des performances proches de Fable 5.1 selon les tests publiés. La nouveauté compte pour les équipes techniques car elle combine baisse de prix, gains de vitesse et routage de sécurité susceptible de modifier le modèle réellement appelé en production. Autrement dit, le nom sur la requête n’est pas toujours celui qui fait le travail.

Un modèle plus sobre, mais pas moins ambitieux

Opus 5.5 est présenté comme le premier jalon de la nouvelle famille 5.5, avant Sonnet 5.5 et Haiku 5.5 dans les semaines suivantes. Anthropic annonce un prix de 4 dollars par million de tokens en entrée et 20 dollars en sortie, contre 5 et 25 dollars pour Opus 5. Selon l’entreprise, le coût global baisse d’environ 40% grâce à une meilleure efficience et à des sorties générées plus rapidement, avec un gain de plus de 30% en vitesse. La société dit aussi avoir amélioré le style d’écriture, jugé plus naturel par les premiers testeurs. Les modèles bavards ne sont jamais très populaires quand vient l’heure de payer la facture.

Les comparaisons avancées par Anthropic placent Opus 5.5 au niveau de Fable 5.1 sur plusieurs tâches, avec des écarts favorables sur certains benchmarks d’agents. Sur Terminal-Bench 4.0, il obtient 66,4% contre 55,8% pour Fable 5.1 ; sur FrontierCode, 54,4% contre 50,3%. En interne, Anthropic affirme avoir vu des portages et audits réalisés plus vite, avec moins de tokens consommés. Box dit ainsi avoir utilisé environ un tiers de tokens en moins lors de ses évaluations. GitHub a testé le modèle dans Copilot CLI et VS Code et a relevé moins d’étapes pour terminer des tâches terminal. Deloitte évoque de son côté 72% de bugs détectés en revue de code au réglage le plus économe, contre 56% pour Opus 5 en mode plus coûteux.

Des quotas plus généreux pour les abonnés

Le lancement ne se limite pas à l’API. Anthropic augmente de 20% la limite d’usage sur cinq heures pour l’ensemble des abonnements, et dit que le nouveau tarif permet jusqu’à 25% d’usage supplémentaire sur les fenêtres de cinq heures et hebdomadaires. L’entreprise introduit aussi un banked rate-limit reset, un reset de quota que l’utilisateur peut conserver pour les moments où il a besoin de plus de capacité. Cette mécanique vise clairement les usages intensifs des développeurs, où la friction naît souvent moins du modèle que de la limite de passage.

Les tarifs de Claude Code et de la plateforme Claude suivent la même logique, avec un mode rapide annoncé jusqu’à 2,5 fois plus véloces, facturé 8 dollars par million de tokens en entrée et 40 dollars en sortie. Anthropic pousse donc la différenciation sur l’économie d’usage plutôt que sur le seul score de benchmark. Pour les équipes produit, c’est le genre de détail qui change le choix d’un fournisseur sans faire de bruit.

Quand la sécurité reroute les requêtes

La partie la plus sensible du lancement tient au fonctionnement des garde-fous. Opus 5.5 embarque les mêmes classes de classificateurs de sécurité que Fable 5.1 pour la cybersécurité, la biologie et le développement de grands modèles. Lorsqu’un classificateur se déclenche, Anthropic redirige la requête vers un modèle plus ancien : la plupart des demandes jugées sensibles en cybersécurité vont vers Opus 4.8, tandis que les cas liés à la biologie et au développement de modèles sont basculés vers Opus 5. Cela peut créer, dans un workflow agentique, une variabilité invisible entre étapes successives. [à vérifier]

C’est ici que le sujet dépasse la simple fiche produit. Une chaîne d’agents peut raisonner comme si elle parlait toujours à Opus 5.5, alors qu’une partie des appels passe en réalité par d’autres versions avec des capacités différentes. Anthropic dit que des organisations vérifiées peuvent demander l’accès via son programme de vérification en sciences de la vie sans le classificateur biologie, et que son programme cyber doit s’étendre au nouveau modèle dans les prochaines semaines. Les équipes qui industrialisent des agents devront donc tracer non seulement le modèle demandé, mais aussi le modèle effectivement servi.

La vraie bataille se joue dans l’exécution

Au fond, le lancement illustre une bascule déjà visible dans l’IA générative : la performance brute ne suffit plus. Anthropic insiste sur l’alignement, c’est-à-dire la capacité du modèle à éviter des comportements dangereux ou incohérents, et dit avoir renforcé ses filtres d’entraînement après avoir identifié des environnements de renforcement défectueux comme source de dérives. Cette approche compte pour les usages agentiques, où le modèle choisit lui-même des outils, enchaîne des actions et peut partir dans le décor si le cadre d’exécution est mal conçu.

La concurrence, elle, se déplace vers le coût par tâche et la stabilité du routage. OpenAI a déjà abaissé ses prix d’API cet été, et Anthropic répond ici en combinant baisse tarifaire, gains d’efficacité et mécanismes de sécurité plus stricts. Pour les développeurs, le vrai sujet n’est donc plus seulement “quel modèle est le meilleur”, mais “quel modèle fait le travail attendu, au bon coût, sans changer de moteur en plein virage”.

En chiffres

  • 4 $ — million de tokens en entrée, Claude Opus 5.5, 22 septembre 2026.
  • 20 $ — million de tokens en sortie, Claude Opus 5.5, 22 septembre 2026.
  • 66,4 % — score d’Opus 5.5 sur Terminal-Bench 4.0.
  • 54,4 % — score d’Opus 5.5 sur FrontierCode v1.1.
  • 2,5 fois — vitesse maximale annoncée du mode rapide Claude Code et Claude Platform.

À lire