Claude Sonnet 5.5 arrive dans GitHub Copilot et accélère le codage
Anthropic rend Claude Sonnet 5.5 disponible dans GitHub Copilot. Le modèle vise les tâches de codage courantes, avec moins d’étapes et des réponses plus rapides selon les premiers tests de GitHub.
GitHub Copilot intègre désormais Claude Sonnet 5.5, le dernier modèle Sonnet d’Anthropic, pour les tâches de code bien cadrées comme la création de fonctionnalités et la correction de bogues. Le déploiement est progressif pour les utilisateurs Pro, Pro+, Max, Business et Enterprise, et l’enjeu est simple : faire gagner du temps aux développeurs sans changer leurs habitudes. Dans ses premiers tests, GitHub dit avoir vu moins d’étapes, moins de jetons et moins d’appels d’outils, avec une exécution plus rapide.
Un modèle pensé pour les tâches du quotidien, pas pour jouer les héros
Anthropic présente Claude Sonnet 5.5 comme un successeur direct de Sonnet 5, avec un positionnement très clair : aider sur les travaux logiciels du quotidien, mais aussi sur les documents, les feuilles de calcul, les présentations et la conception d’interfaces. La société le décrit comme son Sonnet le plus rapide à ce jour. Son modèle plus ambitieux, Opus 5.5, reste réservé aux tâches plus ouvertes et plus lourdes, où le jugement dans la durée compte davantage que la vitesse brute.
Sur le terrain, la promesse est moins spectaculaire qu’une annonce de chatbot qui “change tout”, mais elle parle aux équipes produit et aux développeurs : moins de tours de dialogue, moins d’itérations, donc moins de friction. GitHub indique que Sonnet 5.5 a égalé Sonnet 5 sur des tâches de codage tout en mobilisant sensiblement moins de ressources. L’amélioration compte surtout dans les environnements où les demandes sont répétitives et précises.
Des gains de vitesse, et une facture qui peut baisser
Anthropic affirme que Sonnet 5.5 produit des réponses de plus de 30 % plus vite et peut coûter jusqu’à 30 % de moins pour la plupart des usages, parce qu’il consomme moins de jetons. Le tarif à l’unité, lui, ne bouge pas : 2 dollars par million de jetons en entrée, 10 dollars par million en sortie, 0,20 dollar par million pour la lecture de cache et 2,50 dollars par million pour l’écriture de cache. En clair, le coût final dépendra surtout de la quantité de travail réellement demandée au modèle.
Le modèle est disponible sur plusieurs environnements : GitHub Copilot, certes, mais aussi la plateforme Claude, AWS, Google Cloud et Microsoft Azure. Dans Copilot, il apparaît dans les outils habituels, de Visual Studio Code à Xcode, en passant par JetBrains IDEs, Eclipse, le CLI Copilot, l’application mobile et github.com. Le déploiement restant graduel, certains utilisateurs devront patienter un peu avant de voir la nouvelle entrée dans le sélecteur de modèle.
Des benchmarks solides, mais à lire avec prudence
Les chiffres publiés par Anthropic donnent une idée du saut revendiqué. Sonnet 5.5 atteint 70,6 % sur Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5, et 55,5 % sur CursorBench 4.0, contre 34,1 %. À effort maximal, il monte à 46,2 % sur FrontierCode 1.1 Main, contre 42,4 % pour son prédécesseur. Le modèle affiche aussi 80,1 % sur OSWorld 2.1 en score partiel, contre 57,0 % pour Sonnet 5, et se rapproche d’Opus 5.5 sur GDPval-AA, un test de connaissances appliquées.
Ces résultats restent des mesures de laboratoire, utiles pour situer un modèle mais pas pour garantir une performance identique dans une base de code réelle. Pour autant, la combinaison vitesse + coût + disponibilité large donne à Sonnet 5.5 un positionnement très pratique pour les équipes qui passent leurs journées à corriger, générer et relire. Le modèle n’a pas vocation à remplacer Opus sur les cas complexes. Il le complète, ce qui est déjà beaucoup.
Un déploiement encadré, y compris sur la sécurité
Anthropic dit avoir ajouté à Sonnet 5.5 ses premiers garde-fous cyber et un comportement de repli pour les requêtes à plus haut risque, sur le modèle de ce qui a été fait pour Opus 5.5. Les protections biologiques restent, selon la société, identiques à celles de Sonnet 5, tandis que de nouveaux classificateurs ciblent l’extraction de raisonnement et que la fonction de pensée préservée a été élargie. Ces contrôles ne devraient pas gêner le développement logiciel courant ni la plupart des usages en sciences de la vie.
Pour les administrateurs de Copilot Business et Enterprise, l’accès se pilote depuis la politique de modèle dans les paramètres Copilot. Les nouveaux modèles sont activés par défaut, sauf désactivation explicite par un administrateur. Un détail qui a son importance, car les grandes équipes aiment généralement garder la main sur ce qui entre dans leurs outils de production. Haiku 5.5 doit suivre dans les prochaines semaines, ce qui achèvera de dessiner la gamme Claude 5.5.
En chiffres
- Plus de 30 % — vitesse annoncée par Anthropic pour Sonnet 5.5.
- Jusqu’à 30 % — baisse de coût revendiquée pour la plupart des tâches.
- 70,6 % — score sur Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5.
- 55,5 % — score sur CursorBench 4.0, contre 34,1 % pour Sonnet 5.
- 80,1 % — score partiel sur OSWorld 2.1, selon Anthropic.