Claude Sonnet 5.5 rapproche Anthropic du haut de gamme à moindre coût
Anthropic lance Claude Sonnet 5.5, un modèle plus rapide et jusqu’à 30 % moins cher par tâche que Sonnet 5. Il s’approche d’Opus 5.5 sur plusieurs benchmarks, surtout en code et en travail documentaire.
Anthropic a lancé Claude Sonnet 5.5, un modèle d’IA conçu pour les tâches du quotidien professionnel comme corriger du code, rédiger des documents ou préparer des tableaux, tout en restant plus abordable que son grand frère Opus 5.5. La société dit qu’il génère des réponses plus de 30 % plus vite et réduit le coût par tâche jusqu’à 30 % grâce à une meilleure utilisation des tokens. Le modèle est disponible sur Claude Platform, AWS, Google Cloud et Microsoft Azure, dans un contexte où la facture compte presque autant que la performance.
Un modèle intermédiaire qui joue très près du sommet
Sonnet 5.5 ne prend pas la place d’Opus 5.5, que Anthropic réserve aux tâches les plus ouvertes et les plus délicates. En revanche, il s’en approche franchement sur plusieurs tests, au point de brouiller la vieille hiérarchie entre “modèle premium” et “modèle de travail”. Sur GDPval-AA, un benchmark de travail de connaissance couvrant 44 professions et neuf secteurs, Sonnet 5.5 obtient 1 844 points, contre 1 846 pour Opus 5.5 et 1 449 pour Sonnet 5.
Sur le terrain du code, l’écart se resserre encore. Anthropic annonce 70,6 % sur Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5 et 66,4 % pour Opus 5.5. Sur CursorBench 4.0, Sonnet 5.5 atteint 55,5 %, soit seulement deux points de moins qu’Opus 5.5. Le modèle vise donc les bugs, la documentation, les présentations et les feuilles de calcul, pas les grandes déclarations de principe. Et ça, au moins, reste utile.
Pourquoi Anthropic insiste autant sur le code
Le saut le plus visible se situe dans les usages de développement logiciel. Anthropic explique que Sonnet 5.5 comprend plus vite une base de code, regroupe davantage les appels d’outils et réduit ainsi le nombre d’étapes nécessaires pour terminer une tâche. Sur FrontierCode 1.1, le modèle fait mieux que Sonnet 5 avec un coût par tâche d’environ un quinzième dans la configuration “High”, selon l’entreprise.
Tout n’est pas parfaitement linéaire, cependant. Anthropic note qu’en effort maximum, “Max”, Sonnet 5.5 obtient un score inférieur à celui de son réglage “Xhigh” sur FrontierCode. L’explication avancée tient à un comportement plus agressif de revue de code, qui répartit le travail entre plusieurs sous-agents et peut provoquer des délais ou des modifications hors périmètre. Les modèles raisonnent, mais ils ont parfois leurs petites humeurs.
Prix inchangé, coût réel en baisse
Anthropic conserve le même tarif facial que Sonnet 5 : 2 dollars par million de tokens d’entrée, 10 dollars par million de tokens de sortie et 0,20 dollar pour les lectures en cache. La différence vient de la consommation, que l’entreprise dit bien plus sobre à tâche égale. Selon Anthropic, l’économie effective peut monter jusqu’à 30 %, avec une génération de sortie plus de 30 % plus rapide.
Le modèle propose aussi un réglage d’effort, comme les autres membres de la famille Claude. À faible ou moyen niveau, Sonnet 5.5 dépasserait déjà les meilleurs scores de Sonnet 5 pour environ un dixième du coût par tâche, d’après Anthropic. Reste la vraie question côté entreprises : trouver le bon niveau d’effort pour chaque usage, ce qui ressemble souvent davantage à un arbitrage qu’à une science exacte.
Des garde-fous renforcés sur la cybersécurité
Anthropic ajoute pour la première fois sur un modèle Sonnet des garde-fous similaires à ceux réservés à ses modèles les plus puissants. Les demandes liées à des tâches de cybersécurité à haut risque sont redirigées vers Sonnet 5, tandis qu’un programme de vérification élargi donne un accès par paliers à des professionnels qualifiés. L’entreprise introduit aussi des classificateurs contre les “distillation attacks”, ces tentatives visant à extraire le raisonnement d’un modèle pour entraîner un concurrent.
Ces protections suivent une ligne claire : plus le modèle devient capable, plus Anthropic encadre ses usages sensibles. La société juge en effet que les capacités de Sonnet 5.5 en cybersécurité se rapprochent de celles d’Opus 5.5. Côté déploiement, le modèle est déjà disponible sur les grands clouds et en zéro rétention des données, via l’identifiant claude-sonnet-5-5 pour les développeurs. Anthropic précise aussi qu’un passage depuis un usage sans “thinking” nécessite le réglage between_tools.
Points clés
- Sonnet 5.5 sort le 28 septembre 2026 selon Anthropic.
- 70,6 % sur Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5.
- 1 844 points sur GDPval-AA, à deux points d’Opus 5.5.
- Tarifs inchangés : 2 $ en entrée, 10 $ en sortie.
- Anthropic lance aussi Haiku 5.5 “dans les semaines à venir”.
- Les protections cyber visent aussi les attaques de distillation.
En chiffres
- 30 % — gain de vitesse annoncé par Anthropic, monde, 28 septembre 2026.
- 30 % — baisse du coût par tâche annoncée, monde, 28 septembre 2026.
- 1 844 — score GDPval-AA de Sonnet 5.5, selon Anthropic.
- 44 professions — périmètre du benchmark GDPval-AA.
- 9 secteurs — couverture du benchmark GDPval-AA.