Claude Sonnet 5.5 rapproche Anthropic du haut de gamme à moindre coût
Anthropic lance Claude Sonnet 5.5, un modèle plus rapide et jusqu’à 30 % moins coûteux par tâche que Sonnet 5. Il se rapproche d’Opus 5.5 sur plusieurs tests, tout en arrivant avec de nouveaux garde-fous cybersécurité.
Anthropic a présenté Claude Sonnet 5.5, nouveau modèle de sa famille Claude 5.5, avec une promesse simple à lire pour les entreprises : davantage de performances, une exécution plus rapide et un coût effectif qui baisse jusqu’à 30 % par tâche. Selon la société, le modèle se rapproche même d’Opus 5.5 sur plusieurs benchmarks, ce qui resserre encore l’écart entre les niveaux de gamme. Disponible dès maintenant sur AWS, Google Cloud et Azure, il cible surtout le code et le travail de bureau assisté par IA.
Un modèle intermédiaire qui joue désormais dans la cour du dessus
Sonnet 5.5 vise les tâches bien délimitées du quotidien professionnel : corriger des bugs, rédiger de la documentation, construire des présentations ou générer des tableaux. Opus 5.5 reste positionné sur les tâches les plus délicates, où le jugement compte davantage, mais l’écart de performance se réduit sur plusieurs tests. Sur GDPval-AA, benchmark de travail de connaissance couvrant 44 professions et neuf secteurs, Sonnet 5.5 atteint 1 844 points, contre 1 846 pour Opus 5.5 et 1 449 pour Sonnet 5.
Sur le papier, Anthropic vend donc moins un saut spectaculaire qu’un déplacement du curseur. Le modèle produit aussi des réponses plus de 30 % plus vite, selon la société, tout en utilisant moins de jetons par tâche. Le résultat est assez concret pour peser dans les arbitrages d’achat. Dans une période où le prix redevient un argument très sérieux, ce n’est pas un détail cosmétique, même si les benchmarks aiment parfois mettre un costume trop propre.
Le code, terrain de démonstration préféré d’Anthropic
Les gains les plus visibles concernent la programmation agentique. Sur Terminal-Bench 4.0, Sonnet 5.5 passe à 70,6 %, contre 10,3 % pour Sonnet 5. Sur CursorBench 4.0, qui reconstitue de vraies sessions de développement, il atteint 55,5 %, soit presque le niveau d’Opus 5.5 à 57,8 %. Anthropic affirme aussi que le modèle comprend plus vite une base de code et regroupe davantage les appels d’outils, ce qui réduit le nombre d’étapes nécessaires.
Un détail plus nuancé ressort toutefois du test FrontierCode 1.1 : au niveau d’effort le plus élevé, baptisé “Max”, Sonnet 5.5 obtient un score inférieur à celui mesuré en “Xhigh”. Anthropic explique que le mode Max déclenche plus souvent une fonction de revue de code répartissant le travail entre plusieurs sous-agents, avec parfois des dépassements de temps ou des modifications hors périmètre. Cela rappelle qu’en IA, pousser le curseur au maximum ne règle pas toujours tout. Les machines aussi savent se compliquer la vie.
Prix identique, coût réel en baisse
Anthropic maintient le tarif affiché à $2 par million de jetons d’entrée, $10 par million de jetons de sortie et $0,20 pour les lectures en cache. La baisse vient donc surtout de l’efficacité à l’usage : moins de jetons consommés par tâche, donc une facture effective réduite jusqu’à 30 %, selon l’entreprise. En parallèle, le modèle reste doté d’un réglage d’effort qui permet de choisir entre vitesse, coût et qualité.
Cette logique est importante pour les équipes produit et les directions techniques. Un modèle un peu moins cher à l’exécution, mais presque au niveau d’un très haut de gamme sur des cas bien ciblés, peut faire basculer une architecture ou un budget. Le marché des modèles de langage continue ainsi de se déplacer vers un critère plus terre à terre : combien coûte réellement une tâche utile, pas seulement un million de jetons sur une grille tarifaire.
Des garde-fous renforcés pour la cybersécurité
Anthropic accompagne cette montée en capacité de nouvelles protections. Pour la première fois sur un modèle Sonnet, certaines requêtes à haut risque liées à la cybersécurité sont redirigées visiblement vers Sonnet 5. La société ajoute aussi un programme d’accès vérifié par niveaux pour les professionnels qualifiés, ainsi que des classifieurs destinés à limiter les attaques de distillation, c’est-à-dire les tentatives de copier un modèle puissant en récupérant ses réponses à grande échelle.
Le modèle est accessible sans conservation des données, sur les grandes plateformes cloud et via la Claude Platform avec l’identifiant claude-sonnet-5-5. Anthropic annonce enfin un Claude Haiku 5.5 dans les semaines à venir, orienté vers les usages à fort volume et faible coût. Pour les clients, la famille se densifie ; pour les concurrents, la bataille du rapport performance-prix s’intensifie encore un cran.
Points clés
- Claude Sonnet 5.5 sort le 28 septembre 2026, selon Anthropic.
- Le modèle coûte jusqu’à 30 % moins cher par tâche.
- Sonnet 5.5 atteint 1 844 points sur GDPval-AA.
- Sur CursorBench 4.0, il monte à 55,5 %.
- Anthropic le déploie sur AWS, Google Cloud et Azure.
- Des garde-fous cybersécurité accompagnent le lancement.
En chiffres
- 30 % — baisse annoncée du coût par tâche, selon Anthropic.
- 70,6 % — score sur Terminal-Bench 4.0, benchmark de codage agentique.
- 1 844 points — résultat sur GDPval-AA v2.1, travail de connaissance.
- $2 / $10 — prix par million de jetons d’entrée et de sortie.
- 3 clouds — AWS, Google Cloud et Azure, pour la disponibilité initiale.