Claude Opus 5.5 baisse ses coûts mais bouscule les agents

Anthropic lance Claude Opus 5.5 avec un prix plus bas et des performances proches de Fable 5.1. Mais la mise à jour impose aussi des changements qui peuvent casser des agents existants.

Anthropic a lancé Claude Opus 5.5 le 22 septembre 2026, première référence de sa nouvelle famille Claude 5.5. Le modèle promet des coûts plus bas et des performances proches de Fable 5.1 sur la plupart des tâches, mais sa migration peut déclencher des erreurs sur des agents déjà en production. Pour les équipes qui automatisent du code, du support ou du travail de bureau, le message est clair : le gain de prix s’accompagne d’un vrai travail d’intégration.

Une baisse de prix, mais pas un simple remplacement

Sur le papier, Opus 5.5 ressemble à une bonne affaire. Anthropic affiche un tarif de 4 dollars par million de jetons en entrée et 20 dollars par million en sortie, contre 5 et 25 dollars pour Opus 5. La société dit aussi que les lectures de cache tombent à 0,20 dollar par million de jetons, contre 0,50 dollar auparavant. Selon Anthropic, un usage type revient ainsi 40 % moins cher qu’avec Opus 5, avec une génération de réponses de plus de 30 % plus rapide.

Le modèle garde une fenêtre de contexte de 1 million de jetons et une sortie maximale de 128 000 jetons. Anthropic le positionne sur le codage agentique, l’usage d’ordinateur et le travail de connaissance. Autrement dit, les tâches où l’on veut aller vite sans faire exploser la facture. Le cloud adore ce genre d’arbitrage. Les équipes un peu moins quand il faut tout recâbler.

Ce que change Opus 5.5 pour les agents

La migration ne se limite pas à changer l’identifiant du modèle. La guide d’Anthropic signale quatre changements qui peuvent renvoyer des erreurs 400 à des requêtes prévues pour Opus 5. D’abord, le réglage du thinking devient toujours actif : il n’est plus possible de le désactiver, et les appels qui utilisaient enabled avec budget_tokens sont rejetés. Ensuite, le niveau d’effort par défaut passe de high à medium, ce qui peut modifier la qualité ou la latence sans prévenir.

Troisième point : les appels forcés d’outils ne passent plus avec tool_choice réglé sur any ou tool. Enfin, les blocs de réflexion sont désormais liés au modèle et à la conversation qui les a produits. Une troncature d’historique, une modification d’outil ou un résumé côté client peut donc invalider l’échange. Sur les comptes créés à partir du 31 août 2026 à minuit UTC, la reprise d’un bloc de réflexion invalide renvoie une erreur 400 par défaut. Pour les autres, l’éditeur laisse passer l’appel, ce qui est parfois plus vicieux qu’un refus net.

Une version plus stricte sur la sécurité

Anthropic accompagne aussi Opus 5.5 de garde-fous renforcés sur la cybersécurité et la biologie. D’après les éléments publiés, les requêtes de cybersécurité sensibles sont souvent redirigées vers Opus 4.8, tandis que certaines requêtes biologiques peuvent basculer vers Opus 5. La société dit aussi vouloir élargir son Cyber Verification Program pour permettre à des praticiens vérifiés d’accéder au modèle dans un cadre légitime.

Le modèle aurait tenté de contourner les limites de test 85 % moins souvent qu’Opus 5 ou Claude Mythos 5.1 lors des tests internes, selon des déclarations rapportées par The Verge. Anthropic précise que les cas détectés étaient de faible gravité et auto-signalés par le modèle. Sur ce terrain, la prudence n’a rien d’un luxe. Un agent qui coupe au milieu d’une tâche parce qu’un système de sécurité a mal interprété la demande, ça n’amuse personne.

Où il est disponible et ce qu’annonce la suite

Claude Opus 5.5 est disponible sur les plateformes d’Anthropic ainsi que chez Amazon Web Services, Google Cloud et Microsoft Azure, sous l’identifiant claude-opus-5-5. Anthropic prévoit aussi de publier Claude Sonnet 5.5 et Claude Haiku 5.5 dans les semaines suivantes. La montée en gamme est donc réelle, mais elle s’accompagne d’un message très net aux développeurs : il faut tester la migration en environnement de développement avant de faire passer le trafic de production.

Dans ce contexte, Opus 5.5 n’est pas seulement un modèle moins cher. C’est aussi un rappel que les agents ne cassent pas toujours à cause du modèle lui-même, mais souvent à cause de tout ce qui l’entoure : outils, routage, historique et affichage des réponses. C’est moins glamour qu’un score de benchmark, mais c’est généralement là que se joue la suite.

Points clés

  • Lancement le 22 septembre 2026, selon Anthropic.
  • Prix en entrée: 4 dollars par million de jetons.
  • Prix en sortie: 20 dollars par million de jetons.
  • Coût type annoncé: 40 % inférieur à Opus 5.
  • Anthropic cite 66,4 % sur Terminal-Bench 4.0.
  • Les comptes créés après le 31 août 2026 sont plus strictement contrôlés.

À lire