Les modèles ouverts restent à 4,4 mois des meilleurs modèles fermés
Mozilla estime que les modèles ouverts accusent 4,4 mois de retard sur les modèles fermés, selon son rapport State of Open Source AI publié le 14 septembre 2026. L’écart se resserre, mais il reste net sur l’autonomie, le coût et la fiabilité.
Mozilla a publié le 14 septembre 2026 une nouvelle édition de son rapport State of Open Source AI, qui compare les modèles ouverts aux modèles fermés dits frontier. Le constat principal tient en un chiffre : les modèles ouverts accusent un retard d’environ 4,4 mois. Ce décalage compte, car il mesure non seulement la performance brute, mais aussi la vitesse à laquelle l’IA accessible progresse face aux offres propriétaires d’Anthropic, OpenAI ou Google.
Un retard qui se mesure en mois, pas en années
Le rapport ne s’appuie pas sur une seule série de tests. Mozilla croise les classements de capacité d’Epoch AI, les mesures d’autonomie de METR, les indices de prix et de performance d’Artificial Analysis, ainsi que le trafic observé sur OpenRouter, sans oublier une enquête menée auprès de plus de 1 400 développeurs. Cette méthode donne une image plus nuancée que les classements de démonstration qu’on voit défiler à toute vitesse. Sur l’indice composite ECI utilisé par Epoch AI, le meilleur modèle ouvert cité, Kimi K3 de Moonshot, obtient 157 points contre 162 pour les modèles fermés de tête Claude Fable 5 et Opus 5 d’Anthropic. Epoch estime que cet écart correspond à environ quatre mois de R&D.
Mozilla arrive à un ordre de grandeur voisin avec une autre lecture, celle de METR et de son « horizon temporel ». Cet indicateur désigne la durée maximale d’une tâche complexe qu’un agent peut accomplir seul avec 50 % de réussite, comparée au temps qu’un humain qualifié mettrait pour la faire. Selon le rapport, cet horizon double tous les 5,5 mois pour les modèles fermés, contre tous les 3,9 mois pour les modèles ouverts. Résultat : à l’instant de l’étude, un modèle fermé peut gérer des tâches environ 1,74 fois plus longues qu’un modèle ouvert.
Pourquoi le coût reste l’autre argument des modèles ouverts
Sur le terrain économique, l’écart est moins défavorable aux modèles ouverts. D’après Mozilla, Kimi K3 n’est distancé que de 2,1 points par Fable 5 sur l’indice d’Artificial Analysis, pour environ 30 % de son tarif via API. Autrement dit, les modèles ouverts restent plus abordables à l’usage, ce qui pèse dans les choix des développeurs et des entreprises qui veulent contenir leurs factures d’inférence. L’équation n’est pas parfaite, mais elle attire. Et les budgets, eux, ne font pas de poésie.
Le rapport souligne aussi que les modèles ouverts surpassent parfois les fermés sur certains usages précis. Ils sont devant sur le code d’interfaces web, à égalité sur certaines tâches d’agents autonomes comme la navigation web ou le terminal, mais restent distancés sur le travail de bureau expert, notamment la rédaction de rapports, l’analyse longue et les tâches évaluées par des professionnels du métier. Cette « frontière en dents de scie » rappelle que la performance d’un modèle dépend fortement du cas d’usage, pas seulement de sa place dans un classement.
Des limites de mesure à garder en tête
Mozilla prend soin de signaler les limites de son propre exercice. Sa reproduction de la méthode METR est qualifiée de simplifiée, et les mesures au-delà de 16 heures d’autonomie sont jugées peu fiables. Les données concernant Claude Mythos ont aussi été écartées, car considérées hors du domaine de validité du test. De son côté, Epoch prévient que l’écart réel pourrait être plus grand, notamment parce que certains modèles fermés non publiés manquent au comparatif et que les modèles ouverts peuvent être optimisés de façon très ciblée pour ces benchmarks.
Le document donne donc une tendance, pas un verdict gravé dans le silicium. Mais cette tendance compte : alors que les appels à réguler l’IA se multiplient, un écart qui se referme entre modèles ouverts et fermés change la donne pour la recherche, les développeurs et les acteurs qui misent sur des alternatives moins verrouillées. Dans ce contexte, la bataille ne se joue plus seulement sur la puissance. Elle se joue aussi sur l’accès, le coût et la capacité à tenir dans la durée.
Points clés
- Mozilla publie son rapport le 14 septembre 2026.
- Les modèles ouverts accusent 4,4 mois de retard.
- Kimi K3 obtient 157 points sur l’ECI.
- Claude Fable 5 et Opus 5 montent à 162 points.
- METR estime l’horizon des modèles fermés à 5,5 mois.
- Le meilleur modèle ouvert coûte environ 30 % de moins.
En chiffres
- 4,4 mois — retard estimé des modèles ouverts, rapport Mozilla, 14 septembre 2026.
- 1 400 développeurs — échantillon de l’enquête Mozilla, 2026.
- 157 points — score de Kimi K3 sur l’ECI, selon Epoch AI.
- 162 points — score de Claude Fable 5 et Opus 5, selon Epoch AI.
- 30 % — écart de coût d’usage en faveur des modèles ouverts, selon Artificial Analysis.