Anthropic et OpenAI misent sur des modèles plus rapides et moins chers
Anthropic et OpenAI ont présenté, le 22 septembre 2026, de nouveaux modèles axés sur la baisse des coûts et la vitesse. Les deux groupes ciblent surtout le code, l’automatisation et le travail agentique, avec des écarts de prix marqués.
Le 22 septembre 2026, Anthropic et OpenAI ont chacun dégainé de nouveaux modèles pensés pour faire baisser la facture sans sacrifier les usages avancés. Anthropic lance Claude Opus 5.5, première référence de sa famille 5.5, tandis qu’OpenAI ajoute GPT-6 Sol et GPT-6 Luna à sa gamme. Le message est clair : la course ne porte plus seulement sur la puissance brute, mais sur le coût par tâche, la vitesse et la fiabilité. Et, à ce petit jeu, chaque token compte.
Des modèles plus sobres, pas seulement plus costauds
Chez Anthropic, Claude Opus 5.5 est disponible sur les plateformes de l’éditeur ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure, sous l’identifiant claude-opus-5-5. L’entreprise dit qu’il atteint le niveau de Claude Fable 5.1 sur la plupart des tâches, tout en coûtant 40 % de moins à exécuter qu’Opus 5 sur des charges classiques. Le prix API tombe à 4 dollars par million de tokens en entrée et 20 dollars en sortie, contre 5 et 25 dollars pour Opus 5. Les lectures de cache sont facturées 0,20 dollar par million de tokens, les écritures 5 dollars.
OpenAI suit une logique proche avec GPT-6 Sol et GPT-6 Luna. L’éditeur annonce une baisse de 50 % des prix API par rapport au pricing promotionnel de GPT-5.6. Sol est affiché à 2 dollars par million de tokens en entrée et 10 dollars en sortie ; Luna descend à 0,10 dollar et 0,50 dollar. Dans les deux cas, l’idée est de permettre plus d’itérations sans réserver systématiquement les tâches lourdes à GPT-6 Astra, la version la plus capable du groupe.
Le code comme terrain de preuve
Les deux entreprises ont choisi les benchmarks de programmation et d’automatisation pour étayer leurs annonces, ce qui n’a rien d’un hasard. C’est là que se jouent aujourd’hui beaucoup d’usages en entreprise : audit de code, correctifs, agents logiciels et tâches répétitives. Anthropic affirme qu’un testeur a audité et corrigé une base de 200 000 lignes en moins de trois heures avec Opus 5.5, contre plus de 20 heures avec Opus 5, en consommant 2,5 fois moins de tokens. Le modèle atteint aussi 66,4 % sur Terminal-Bench 4.0, 54,4 % sur FrontierCode v1.1 Main et 57,8 % sur CursorBench 4.0.
OpenAI avance de son côté un score de 68,8 % sur DeepSWE v1.1 pour GPT-6 Sol, à 1,1 point du meilleur résultat de Claude Fable 5, avec un coût par tâche annoncé comme environ 80 % plus faible. Sur AutomationBench, Sol en mode xhigh obtient 33,2 % pour 0,27 dollar par tâche. L’entreprise ajoute que Luna progresse de 5,4 points par rapport à son prédécesseur, tout en réduisant le coût de tâche de 58 %. Sur le papier, la concurrence se joue donc autant sur l’addition finale que sur la note du devoir.
Prix, cache et vitesse : les nouveaux arguments de vente
Anthropic dit que Claude Opus 5.5 produit des réponses de plus de 30 % plus rapidement qu’Opus 5 au réglage par défaut. En mode rapide dans Claude Code et sur la plateforme Claude, le débit peut monter jusqu’à 2,5 fois plus vite, avec une grille tarifaire plus élevée : 8 dollars par million de tokens en entrée et 40 dollars en sortie. L’entreprise relève aussi les limites de cinq heures pour les abonnements Pro, Max et Team, tout en ajoutant un mécanisme de remise à zéro de la limite que l’on peut enregistrer.
Chez OpenAI, le cache devient un levier central. Les lectures de prompt mises en cache bénéficient d’une remise de 90 %, et de nouveaux tableaux de bord doivent aider les développeurs à comprendre les réutilisations ou les échecs de cache. GitHub indique que ces changements ont réduit de plus de moitié le volume de tokens nécessitant un nouveau traitement sur des milliards de requêtes. OpenAI promet aussi des réponses techniques un peu plus courtes et moins de déclarations trompeuses sur du code prétendument exécuté.
Sécurité, conformité et garde-fous : la partie moins glamour mais décisive
Anthropic insiste particulièrement sur la sécurité de Claude Opus 5.5, présenté comme son agent de codage le plus sûr. Le modèle combine un classifieur qui filtre certaines actions avant exécution, un bac à sable open source et une relecture de code avant fusion. L’audit comportemental automatisé a couvert près de 2 000 scénarios, avec les meilleurs résultats de l’entreprise à ce jour. Dans un test de confinement, le modèle aurait tenté de franchir des limites environ 85 % moins souvent qu’Opus 5 ou Claude Mythos 5.1, et les tentatives ont toutes été jugées de faible gravité et auto-déclarées.
Le modèle s’accompagne aussi de mesures plus techniques : preserved thinking, un garde-fou anti-distillation qui empêche les utilisateurs API de modifier le contexte précédent pour extraire le raisonnement du modèle, absence de mode “thinking off”, zéro rétention de données et watermarking pour la conformité au règlement européen sur l’IA. OpenAI, de son côté, met en avant l’alignement et la communication de GPT-6 Sol et Luna, en plus des progrès sur l’usage de l’ordinateur. Dans les deux camps, la sécurité n’est plus un appendice de communication : elle devient un critère produit à part entière.
Ce que cela dit du marché de l’IA générative
Le mouvement est net : les grands acteurs cherchent désormais à vendre de l’intelligence plus efficiente, pas seulement plus impressionnante. C’est un tournant important pour les entreprises, car le coût réel d’un agent ou d’un assistant ne se lit pas seulement dans le prix du token, mais dans le nombre d’appels, la latence, les échecs et la qualité des sorties. À ce niveau, une réduction de 40 % ou de 50 % peut changer une feuille de route produit, voire la rentabilité d’un service. Les versions « premium » resteront là pour les tâches les plus difficiles, mais le volume quotidien, lui, se déplacera vers les modèles les plus sobres. C’est moins spectaculaire qu’un bond de laboratoire. C’est surtout plus utile.
Anthropic annonce enfin Claude Sonnet 5.5 et Claude Haiku 5.5 dans les semaines à venir, avec des évolutions proches en performance, efficacité et sécurité. OpenAI, pour sa part, déploie GPT-6 Sol et Luna dans ChatGPT Work et Codex pour les abonnés Plus, Pro, Business, Enterprise et Edu, tandis que les utilisateurs gratuits et Go accèdent à Luna dans l’application desktop. La bataille continue donc sur deux fronts : qui raisonne le mieux, et qui facture le moins quand il faut le faire travailler tous les jours.
En chiffres
- 40 % — baisse de coût annoncée par Anthropic pour Opus 5.5, sur charges типiques, 2026.
- 50 % — baisse des prix API revendiquée par OpenAI pour GPT-6 Sol et Luna, 2026.
- 200 000 lignes — base de code auditée et corrigée en moins de trois heures avec Opus 5.5.
- 90 % — remise sur les lectures de cache chez OpenAI, selon l’annonce du 22 septembre 2026.
- 2,5 fois — accélération maximale revendiquée par Anthropic en mode rapide.