Claude Sonnet 5.5 mise sur la vitesse et les tâches du quotidien

Anthropic lance Claude Sonnet 5.5, un modèle présenté comme plus rapide et jusqu’à 30 % moins coûteux à l’usage que Sonnet 5. Disponible sur la plateforme Claude et chez AWS, Google Cloud et Azure, il cible les tâches courantes et le développement.

Anthropic a dévoilé Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5 après Opus 5.5. La start-up américaine le présente comme un complément plus rapide et moins coûteux, pensé pour les tâches bien cadrées du quotidien, de la correction de bugs à la production de documents ou de feuilles de calcul. Le modèle est déjà disponible sur la plateforme Claude, ainsi que sur AWS, Google Cloud et Microsoft Azure, mais il reste fermé aux poids ouverts, donc impossible à auto-héberger. Et oui, l’IA continue de sortir de nouvelles versions à un rythme qui ferait rougir un calendrier de mise à jour.

Un modèle pensé pour aller plus vite, pas pour faire le tout-terrain

Sonnet 5.5 vise d’abord les usages où la vitesse compte autant que la qualité. Selon Anthropic, il génère ses réponses plus de 30 % plus vite que Sonnet 5 et peut coûter jusqu’à 30 % de moins à la tâche, non pas parce que le tarif catalogue baisse, mais parce qu’il consomme moins de jetons et d’appels d’outils pour produire le résultat attendu. Le modèle est ainsi positionné comme la brique « rentable » de la gamme, face à Opus 5.5, réservé aux travaux plus complexes et plus ouverts.

Sur le plan fonctionnel, Anthropic met en avant la correction de bugs, la rédaction de documents, la création de présentations et la manipulation de tableurs. Le modèle prend aussi en charge le texte et l’image, avec un contexte de 1 million de jetons et une sortie maximale de 128 000 jetons. Son mode de raisonnement adaptatif est activé par défaut, avec cinq niveaux d’effort : low, medium, high, xhigh et max. Pour les équipes produit et les développeurs, cela compte davantage qu’un simple slogan : la promesse est de réduire les allers-retours, pas seulement d’aller plus vite sur la ligne d’arrivée.

Ce que disent les benchmarks, et ce qu’il faut en retenir

Anthropic a publié plusieurs scores de référence pour situer Sonnet 5.5. Sur Terminal-Bench 4.0, il atteint 70,6 % en Xhigh, contre 10,3 % pour Sonnet 5 et 66,4 % pour Opus 5.5. Sur CursorBench 4.0, il affiche 55,5 %, soit environ deux points de moins qu’Opus 5.5. Sur FrontierCode 1.1, il monte à 52,1 % en Xhigh et 46,2 % en Max, tandis que GPT-6 Sol est annoncé à 49,3 %. Anthropic signale aussi un score de 1844 sur GDPval-AA v2.1, très proche des 1846 d’Opus 5.5, et 80,1 % sur OSWorld 2.1 pour l’usage ordinateur.

Ces chiffres restent des résultats fournis par l’éditeur, donc à lire avec la prudence habituelle [à vérifier]. Ils dessinent toutefois une hiérarchie claire : Sonnet 5.5 progresse nettement sur la génération de code, l’usage d’outils et certaines tâches agentiques, mais Opus 5.5 conserve l’avantage sur les travaux complexes, ouverts et plus exigeants en raisonnement. Anthropic indique aussi que des tests de partenaires, menés avant le lancement, ont montré un gain d’efficacité et de vélocité à moindre coût sur des flux réels.

La sécurité, un argument qui pèse autant que les performances

Anthropic met en avant des protections de cybersécurité comparables à celles d’Opus 5 pour Sonnet 5.5. C’est le premier modèle de la gamme Sonnet à intégrer ces garde-fous de niveau élevé. Dans les cas jugés plus risqués, certaines requêtes sont automatiquement redirigées vers Sonnet 5. Le modèle embarque aussi des filtres contre la « distillation », une technique qui consiste à copier les capacités d’un modèle pour créer une version dérivée. Le terme est technique, mais l’enjeu est simple : éviter qu’un concurrent ou un acteur malveillant récupère trop facilement un savoir-faire déjà entraîné.

Le sujet n’est pas anecdotique pour Anthropic, qui pousse en parallèle sa stratégie de contrôle des usages et de sécurité. La société rappelle que Sonnet 5.5 est disponible dès maintenant sur son offre maison, ainsi que chez les grands clouds américains. Les tarifs publics, eux, restent à 2 dollars par million de jetons en entrée et 10 dollars en sortie, avec 0,20 dollar pour les lectures en cache et 2,50 dollars pour les écritures. La facture ne baisse donc pas sur l’étiquette ; c’est l’exécution qui devient plus sobre.

En chiffres

  • 30 %+ — gain de vitesse annoncé par Anthropic face à Sonnet 5.
  • 30 % — baisse possible du coût par tâche selon Anthropic.
  • 1 million de jetons — fenêtre de contexte du modèle.
  • 128 000 jetons — sortie maximale annoncée.
  • 2 $ / 10 $ — prix catalogue par million de jetons entrée/sortie.

À lire