DeepSeek ajuste ses prix avec V4-Pro-0813 et accentue la pression sur OpenAI
DeepSeek déploie V4-Pro-0813 sur son API et son chat, avec des tarifs de 0,435 dollar par million de tokens en entrée et 0,87 dollar en sortie. Le laboratoire chinois reste aussi très sollicité: il serait deuxième en volume de tokens consommés en juillet [à vérifier].
DeepSeek met en circulation V4-Pro-0813 sur son API et son service de chat, avec un prix affiché de 0,435 dollar par million de tokens en entrée et 0,87 dollar en sortie. Cette nouvelle version arrive alors que le laboratoire chinois serait, en juillet, le deuxième plus gros consommateur de tokens après Anthropic [à vérifier], signe d’une demande qui reste forte malgré une capacité de calcul limitée.
Un modèle de plus dans une guerre des prix déjà bien engagée
Le mouvement de DeepSeek intervient dans un contexte de baisse agressive des tarifs chez OpenAI, qui a récemment réduit jusqu’à 80 % le prix de GPT-5.6 Luna selon la source fournie: 0,2 dollar par million de tokens en entrée, contre 1 dollar auparavant, et 1,20 dollar en sortie, contre 6 dollars. DeepSeek répond avec une autre stratégie: rendre ses modèles plus abordables tout en gardant une promesse de performance élevée, ce qui lui permet de rester visible dans une compétition où le coût d’usage compte autant que les benchmarks.
La version V4-Flash-0731, lancée juste après, a été présentée comme un modèle de classe Flash de 284 milliards de paramètres, avec des résultats proches d’Anthropic Opus 4.8 sur certains tests selon des publications relayées sur WeChat [à vérifier]. Sa tarification annoncée, 0,14 dollar par million de tokens en entrée et 0,28 dollar en sortie, pousse encore plus loin cette logique de prix plancher. Le message est clair: DeepSeek ne cherche pas seulement à suivre la cadence, il essaie aussi de la dicter.
Ce que disent les premiers retours de performance
Les éléments relayés autour de V4-Pro-0813 évoquent des gains sur Terminal Bench 2.1, Cybergym, DeepSWE et AutomationBench face à Opus 4.8, toujours d’après des résultats préliminaires circulant sur WeChat [à vérifier]. La même source lui attribue 1,6 trillion de paramètres, dont 49 milliards actifs, ainsi qu’une fenêtre de contexte d’un million de tokens. Ces chiffres, s’ils se confirment, placeraient le modèle dans le haut du panier technique, avec une facture d’usage nettement inférieure à celle de plusieurs concurrents.
Pour les entreprises et les développeurs, l’enjeu est concret: choisir entre une API plus chère mais mieux établie, ou un modèle moins coûteux qui doit encore prouver sa stabilité à grande échelle. Dans ce contexte, le détail compte, car une latence qui grimpe ou une disponibilité qui faiblit peut vite annuler l’avantage tarifaire. Et personne n’achète une promesse de rapidité si le service mouline au moment de produire.
Une demande qui pèse déjà sur l’infrastructure
Selon les sources fournies, DeepSeek ferait face à une hausse marquée de la demande, au point que la vitesse d’inférence serait parfois ralentie. L’explication avancée tient à une capacité de calcul limitée, autour de 20 000 GPU NVIDIA H100, ce qui reste considérable mais peut devenir tendu quand l’usage s’accélère. Autrement dit, le sujet n’est pas seulement le prix affiché: c’est aussi la capacité à servir sans tomber en panne de souffle.
Dans l’immédiat, V4-Pro-0813 confirme la position de DeepSeek comme concurrent sérieux des grands laboratoires américains sur le terrain des modèles à bas coût. Reste à voir si les performances rapportées en préversion tiendront hors des captures d’écran et des fils WeChat, terrain où tout paraît toujours un peu plus spectaculaire qu’un mardi matin ordinaire.
En chiffres
- 0,435 dollar — million de tokens en entrée pour V4-Pro-0813, selon la source fournie.
- 0,87 dollar — million de tokens en sortie pour V4-Pro-0813.
- 0,14 dollar — million de tokens en entrée pour V4-Flash-0731.
- 20 000 GPU NVIDIA H100 — capacité de calcul évoquée pour DeepSeek.
- 1 million de tokens — fenêtre de contexte annoncée pour V4-Pro-0813.