Qwen 3.8 Max vise les tâches longues et les agents d’entreprise
Alibaba a présenté Qwen 3.8 Max et QwenWork, sa plateforme d’agents pour l’entreprise. Le modèle promet jusqu’à 16 jours d’exécution autonome, avec un accès API déjà ouvert et des poids ouverts annoncés pour la semaine suivante.
Alibaba a présenté Qwen 3.8 Max et lancé QwenWork, un espace de travail pour agents d’entreprise pensé pour enchaîner des tâches sans surveillance humaine continue. Le modèle phare combine 2,4 trillions de paramètres au total, 95 milliards actifs par jeton, une fenêtre de contexte d’un million de jetons et jusqu’à 128.000 jetons en sortie. L’enjeu est simple : faire passer les usages d’assistance ponctuelle à des workflows qui tiennent sur plusieurs jours, ce qui change la donne pour le code, la recherche et certains processus métier.
Un modèle taillé pour les longues séquences, pas pour les démonstrations éclair
Selon Alibaba, Qwen 3.8 Max a tenu un build logiciel autonome pendant 16 jours et un cycle de recherche de 125 heures, tout en améliorant ses scores de raisonnement de 2,71 points lors de ce test. La société cite aussi une performance dans un concours de data science avec une 13e place sur 526 équipes, ainsi qu’un flux de conception de puces en 500 tours qui a réduit le nombre de gates de 8.298 à 678 à 500 MHz. C’est le genre de chiffres qui fait saliver les services R&D, même si les conditions exactes des benchmarks méritent toujours un petit contrôle [à vérifier].
Sur les évaluations indépendantes mentionnées dans la note, Qwen 3.8 Max se classe deuxième sur Vision Arena, quatrième sur Frontend Code Arena, cinquième sur Text Arena et dixième sur Vals Index, avec un score de 66,1. Il affiche aussi 87,3 % sur SWE-bench et 67,4 sur Terminal-Bench 2.1. Dans ce contexte, Alibaba cherche clairement à se placer sur le terrain des agents capables de raisonner, d’agir et de persévérer, pas seulement de répondre vite.
QwenWork, la couche entreprise qui change le terrain de jeu
En parallèle du modèle, Alibaba a lancé QwenWork en bêta publique. Cette plateforme d’agents vise les usages professionnels où l’IA doit naviguer entre plusieurs interfaces, reprendre une tâche après interruption et garder une trace du contexte. Le modèle intègre d’ailleurs un retour visuel natif pour la navigation graphique sur le web, le mobile et le poste de travail. Autrement dit, il ne se contente pas de lire du texte : il regarde aussi l’écran.
L’accès API est déjà ouvert via Qwen Studio, Command Code, Baseten et Hermes Agent, avec un tarif annoncé de 2 dollars par million de jetons en entrée, 6 dollars en sortie et 0,25 dollar en cache. Alibaba promet aussi la publication des poids ouverts dès la semaine suivante pour le modèle phare et pour une version plus petite de 27B paramètres. Mais l’auto-hébergement du 2,4T reste réservé à des supernodes avec au moins 8 GPU H100 ou B200, ce qui limite assez vite la discussion au club des très gros acheteurs.
Pourquoi ce lancement compte au-delà d’un simple score
Qwen 3.8 Max arrive dans une course où les modèles ne sont plus jugés seulement sur leur intelligence brute, mais sur leur capacité à tenir un rôle dans des chaînes de travail réelles. Pour les entreprises, la question n’est plus “répond-il bien ?”, mais “peut-il finir la tâche sans casser le rythme ni le budget ?”. L’équation est plus concrète, et elle touche autant les équipes produit que les directions techniques.
Ce lancement place aussi Alibaba face à OpenAI, Anthropic, Google et Meta sur un terrain plus politique qu’il n’y paraît : celui de la souveraineté des modèles, des poids ouverts et du contrôle de l’exécution. À ce niveau, un agent qui travaille 16 jours d’affilée n’est plus seulement un démonstrateur. C’est un candidat sérieux pour automatiser des morceaux entiers d’opérations, avec les promesses et les risques qui vont avec.
En chiffres
- 2,4 trillions — paramètres totaux de Qwen 3.8 Max, selon Alibaba.
- 95 milliards — paramètres actifs par jeton, selon l’annonce du 5 août 2026.
- 1 million de jetons — fenêtre de contexte annoncée pour le modèle.
- 16 jours — durée d’un build logiciel autonome citée par Alibaba.
- 2 dollars / million de jetons — tarif d’entrée API annoncé pour Qwen 3.8 Max.