Claude Sonnet 5.5 gagne en vitesse et rapproche l’IA de travail

Anthropic lance Claude Sonnet 5.5, un modèle plus rapide et annoncé jusqu’à 30% moins cher à l’usage que Sonnet 5. Il s’approche d’Opus 5.5 sur plusieurs benchmarks, tout en gardant un prix catalogue inchangé.

Anthropic a lancé Claude Sonnet 5.5 le 28 septembre 2026, une version plus rapide de son modèle intermédiaire qui vise les tâches du quotidien, du bugfix au document de travail. Selon l’entreprise, il génère ses réponses plus de 30% plus vite que Sonnet 5 et peut réduire le coût par tâche jusqu’à 30%, sans changement de prix affiché. Le lancement compte aussi pour les équipes produit et les développeurs, car ce modèle s’approche d’Opus 5.5 sur plusieurs benchmarks tout en restant moins coûteux à utiliser à grande échelle.

Un modèle de travail, pas seulement un modèle de démonstration

Anthropic présente Sonnet 5.5 comme un complément plus rapide et moins cher à Opus 5.5, son modèle haut de gamme lancé la semaine précédente. La promesse vise les usages où la vitesse compte presque autant que la qualité : corriger du code, rédiger un support, préparer une présentation ou remplir un tableur sans retoucher chaque cellule. Les premiers testeurs cités par l’entreprise disent aussi qu’il améliore les interfaces utilisateur et suit mieux les gabarits de slides. Bref, le modèle veut faire le travail sans demander un comité de validation à chaque phrase.

La famille Claude 5.5 doit encore s’enrichir d’un modèle Haiku, annoncé pour les prochaines semaines. Dans l’immédiat, Sonnet 5.5 devient la nouvelle option médiane du catalogue d’Anthropic, avec une disponibilité sur la Claude Platform, Amazon Web Services, Google Cloud et Microsoft Azure.

Des scores qui se rapprochent d’Opus 5.5

Sur les benchmarks fournis par Anthropic, le modèle se montre nettement plus compétitif que Sonnet 5. Sur Terminal-Bench 4.0, qui évalue des agents sur des tâches en ligne de commande, Sonnet 5.5 atteint 70,6%, contre 10,3% pour Sonnet 5 et 66,4% pour Opus 5.5. Sur CursorBench, il n’est qu’à environ deux points d’Opus 5.5. Et sur FrontierCode de Cognition, il obtient 52,1% à son deuxième niveau d’effort, contre 54,4% pour Opus 5.5 et 49,3% pour GPT-6 Sol d’OpenAI.

Pour le travail de bureau plus classique, Anthropic annonce un score de 1 844 sur GDPval-AA, un classement basé sur des tâches réelles couvrant 44 métiers. Là encore, l’écart avec Opus 5.5 reste faible, tandis que Sonnet 5 est relégué beaucoup plus loin. L’entreprise dit aussi que le nouveau modèle progresse sur l’usage d’ordinateur et sur Human’s Last Exam. Et, pour les amateurs de tests un peu absurdes mais révélateurs, c’est le premier Sonnet à battre Pokémon Red à partir de simples captures d’écran.

Prix inchangé, usage potentiellement moins cher

Le tarif catalogue de Sonnet 5.5 reste fixé à 2 dollars par million de jetons en entrée et 10 dollars par million en sortie, avec 0,20 dollar par million de jetons pour les lectures en cache. Ce n’est donc pas le prix qui change, mais la quantité de jetons nécessaires pour accomplir une tâche, selon Anthropic. En clair, le ticket reste le même, mais la voiture consomme moins.

Ce point compte pour les entreprises qui industrialisent l’usage des modèles, car la facture dépend moins d’un tarif facial que du volume réellement consommé. Sur ce terrain, Anthropic affirme que plusieurs tâches coûteraient jusqu’à dix fois moins cher qu’avec Sonnet 5, à effort faible ou moyen. La société précise toutefois qu’Opus 5.5 reste « clearly stronger at complex, open-ended work requiring sustained judgment ».

Sécurité et intégration dans les clouds

Sonnet 5.5 embarque aussi des garde-fous de cybersécurité comparables à ceux des modèles les plus puissants d’Anthropic. Pour les requêtes à risque élevé, le système bascule vers Sonnet 5, tandis que les usages courants de correction de bugs restent autorisés. Le modèle est également le premier Sonnet à inclure des classifieurs destinés à empêcher l’extraction de son raisonnement pour entraîner d’autres modèles.

Les développeurs qui utilisaient Sonnet avec le mode de réflexion désactivé devront passer à un nouveau réglage between_tools avant la migration. Enfin, Anthropic aligne ainsi son modèle intermédiaire sur une pratique devenue centrale dans l’IA d’entreprise : ce n’est plus seulement la performance brute qui compte, mais la capacité à tenir dans les outils, les droits d’accès et les politiques de sécurité déjà en place.

Points clés

  • Claude Sonnet 5.5 sort le 28 septembre 2026.
  • Anthropic promet plus de 30% de vitesse en plus.
  • Le coût par tâche baisse jusqu’à 30%.
  • Terminal-Bench 4.0 : 70,6% pour Sonnet 5.5.
  • Le modèle est disponible sur AWS, Google Cloud et Azure.
  • Opus 5.5 reste plus fort sur les tâches complexes.

En chiffres

  • 30%+ — gain de vitesse annoncé par Anthropic, septembre 2026.
  • 30% jusqu’à — baisse du coût par tâche annoncée, septembre 2026.
  • 70,6% — score sur Terminal-Bench 4.0, Anthropic, 2026.
  • 2 dollars / 10 dollars — prix par million de jetons en entrée / sortie.
  • 1 844 — score GDPval-AA, Anthropic, 2026.

À lire