Grok 4.7 baisse ses prix et vise les tâches longues
xAI a lancé Grok 4.7, son nouveau modèle pour le code et le travail de connaissance. L’entreprise promet un meilleur contrôle des réponses, des prix plus bas et une disponibilité immédiate dans Cursor, Grok Build et l’API.
xAI a présenté le 21 septembre 2026 Grok 4.7, un modèle conçu pour le code et le travail de connaissance, avec un tarif d’entrée fixé à 2 dollars par million de tokens en entrée et 6 dollars en sortie. L’entreprise le décrit comme son système le plus capable sur ces usages, tout en le plaçant au même niveau de vitesse et de prix que Grok 4.6. Le lancement compte, car il vise un segment très disputé: les tâches longues, où les modèles ne doivent pas seulement répondre vite, mais tenir la distance sans partir en roue libre.
Un modèle pensé pour les tâches qui durent
Selon l’annonce, Grok 4.7 repose sur une base plus large que Grok 4.6 et sur un entraînement par renforcement plus long, avec un mélange de tâches plus difficile et davantage orienté vers des problèmes qui prennent des heures. xAI dit avoir amélioré la vérification autonome des résultats et la gestion d’un contexte long, deux points décisifs pour le développement logiciel et la production de documents. Le modèle est aussi entraîné à comprendre nativement le Grok Bot harness, l’environnement d’agents présenté le 11 août 2026, ce qui doit l’aider dans les tâches conversationnelles et le travail de bureau. En pratique, xAI veut faire de Grok 4.7 un modèle qui ne se contente pas de commencer fort, mais qui finit proprement.
L’entreprise affirme aussi que le modèle est mieux calibré sur les garde-fous, avec une pile de sécurité entièrement nouvelle. Dans les domaines sensibles comme la cybersécurité et les usages biologiques, xAI dit obtenir à la fois une utilité élevée sur les tâches bénignes et un refus plus fiable des demandes dangereuses. Sur son benchmark HackerBench v0.3, le groupe dit n’avoir laissé passer que 3,3 % des invites à risque, tout en bloquant rarement les travaux de sécurité légitimes. Du côté des partenaires, certains acteurs cybersécurité obtiennent déjà un accès sur invitation aux capacités de red team pour la recherche défensive.
Des scores solides, mais pas toujours leaders
xAI publie plusieurs résultats maison qui montrent une progression nette par rapport à Grok 4.6. Sur CursorBench 4.0, dédié aux tâches de codage longues, Grok 4.7 est annoncé à 46,3 %, contre 40,4 % pour Grok 4.6. Sur DeepSWE v1.1, l’évaluation d’ingénierie logicielle, le modèle atteint 71,0 %, contre 65,2 % pour son prédécesseur. Sur Terminal-Bench 4.0, qui mesure le travail en terminal sur plusieurs heures, il monte à 38,0 %, loin devant les 20,3 % de Grok 4.6, mais derrière 57,9 % pour Fable 5.1 selon le tableau publié par xAI. Même logique sur AA Briefcase v1.1: 1 657 points pour Grok 4.7, contre 1 546 pour Grok 4.6 et 1 678 pour Fable 5.1.
En parallèle, la comparaison indépendante citée par la presse nuance le tableau. Sur l’Artificial Analysis Intelligence Index v4.3.2, Grok 4.7 obtient 46 points et se retrouve au milieu du classement, derrière Claude Fable 5.1 et GPT-6, donnés à 53 points chacun. Sur Terminal-Bench 4.0, cette lecture indépendante place Grok 4.7 à 26 %, loin de GPT-6 Astra à 60 % et de Claude Fable 5.1 à 55 %. Le modèle gagne donc du terrain, mais il ne domine pas partout. C’est un lancement sérieux, pas un coup de menton.
Une stratégie tarifaire agressive, mais pas gratuite pour tout le monde
Le positionnement prix est l’un des éléments les plus visibles du lancement. Grok 4.7 est facturé au même niveau que Grok 4.6, à 2 dollars par million de tokens d’entrée et 6 dollars en sortie, quand GPT-5.6 Sol est affiché à 4 et 20 dollars, et Fable 5.1 à 10 et 50 dollars. xAI propose aussi une variante rapide deux fois plus chère, avec un débit doublé, ainsi qu’un accès gratuit à Grok Build sur x.ai/build. Le modèle est disponible dans Cursor, dans Grok Build, via l’API Grok, dans certains harnesses tiers et sur des plateformes cloud. Pour les éditeurs d’outils et les entreprises, cela réduit la facture d’entrée. Pour xAI, cela met la pression sur les marges, mais aussi sur les concurrents.
Reste une question classique dans ce marché: mieux vaut-il un modèle plus rapide ou un modèle plus endurant? xAI parie sur le second, en promettant moins d’erreurs sur les tâches longues, une meilleure auto-vérification et des garde-fous renforcés. Les benchmarks publiés montrent une amélioration réelle face à Grok 4.6, mais aussi des écarts persistants avec les leaders selon les évaluations retenues. C’est là que se joue la suite: convaincre les développeurs, les équipes produit et les acheteurs entreprise que le rapport prix-performance de Grok 4.7 suffit à faire bouger les usages.
Points clés
- Lancement le 21 septembre 2026 par xAI.
- Prix: 2 dollars et 6 dollars par million de tokens.
- CursorBench 4.0: 46,3 % pour Grok 4.7.
- Terminal-Bench 4.0: 38,0 % selon xAI.
- HackerBench v0.3: 3,3 % de prompts à risque passés.
- xAI dit servir Grok 4.7 dans Cursor et Grok Build.
En chiffres
- 2 dollars — prix pour un million de tokens en entrée, annoncé par xAI le 21 septembre 2026.
- 6 dollars — prix pour un million de tokens en sortie, annoncé par xAI le 21 septembre 2026.
- 46,3 % — score de Grok 4.7 sur CursorBench 4.0, selon xAI.
- 3,3 % — part des invites à risque laissées passer sur HackerBench v0.3, selon xAI.
- 1 695 — score Elo de Grok 4.7 sur GDPval, selon le tableau publié par xAI.