Modèles IA ouverts : 4 mois de retard sur le propriétaire pour un coût 5 fois inférieur
Selon le dernier rapport de Mozilla publié le 15 septembre 2026, l'écart de performances entre les modèles fermés payants et les modèles à poids ouverts n'est plus que de 4,4 mois. Les entreprises basculent désormais leurs travaux de code quotidiens vers ces alternatives ouvertes nettement moins chères.
Fil « Rapport de Mozilla sur l'écart de performances entre modèles ouverts et propriétaires »

Le rapport State of Open Source AI (État de l'IA en source ouverte) de la Fondation Mozilla montre une évolution majeure : la majorité des tâches de développement du quotidien peuvent être confiées à des modèles à poids ouverts (open-weights, des modèles dont les paramètres entraînés sont téléchargeables pour tourner localement ou sur des serveurs dédiés, mais dont les données d'entraînement ne sont pas forcément publiques). Ces modèles ont quasiment rattrapé les modèles propriétaires (closed, réservés aux API payantes des géants américains). Pour les équipes de dev, payer le tarif fort des modèles propriétaires n'a d'intérêt que pour un périmètre très restreint.
Seulement 4 mois d'écart et un coût divisé par 5
L'organisme de recherche indépendant METR mesure la capacité des IA selon leur horizon temporel (time horizon, la durée d'une tâche complexe réalisée par un expert humain que l'IA peut accomplir avec au moins 50 % de réussite). Actuellement, le meilleur modèle fermé gère des tâches allant jusqu'à 12 heures, contre 7 heures pour le meilleur modèle ouvert. Mais cet écart se résorbe en seulement 4 mois : dans quatre mois, le modèle ouvert gérera la tâche de 12 heures, tandis que le modèle fermé atteindra 20 heures. Pour toutes les tâches de moins de 8 heures, les deux types de modèles font l'affaire.
Lorsque tous les modèles sont évalués sur un même banc d'essai neutre (harness, la couche logicielle qui connecte le modèle à ses outils et à sa mémoire), les performances sont frappantes. Sur le test Terminal-Bench 2.1 de la société Vals AI, le modèle ouvert GLM 5.2 de l'entreprise chinoise Z.ai s'affiche à un point près des modèles fermés Claude Opus 4.7 et 4.8 d'Anthropic, pour un coût environ 5 fois inférieur par tâche. De même, le modèle ouvert Kimi K3 de Moonshot AI n'est qu'à trois points du modèle fermé Fable 5 d'Anthropic sur l'indice d'intelligence d'Artificial Analysis, tout en coûtant 30 % de son prix.
« Un modèle fermé gagne sa prime à quelques endroits : le travail d'expert professionnel, la recherche d'information à forte intensité et les longs contextes », explique Raffi Krikorian, directeur de la technologie chez Mozilla.
Une stratégie hybride déjà adoptée en production
Des entreprises comme la plateforme de livraison DoorDash ont déjà adapté leurs architectures : elles utilisent le modèle ouvert Kimi pour le travail quotidien de routine et réservent le modèle fermé Fable aux problèmes d'experts particulièrement complexes. Sur la passerelle d'API OpenRouter (un catalogue centralisé d'accès aux modèles), 8 des 10 modèles les plus utilisés en volume de jetons (tokens, les fragments de mots traités par le modèle) en août 2026 sont désormais à poids ouverts.
Voici un exemple de configuration de routage de requêtes basique, permettant d'adresser la routine à un modèle ouvert et de ne basculer sur un modèle fermé qu'en cas de besoin :
{
"routing_rules": [
{
"task_type": "routine_coding",
"primary_model": "moonshot/kimi-k3",
"fallback_model": "anthropic/fable-5",
"max_cost_per_task_usd": 0.05
}
]
}
Géopolitique et souveraineté du code
Le rapport soulève également une concentration importante : la plupart des grands modèles ouverts actuels proviennent de laboratoires chinois, tandis que les modèles fermés restent la propriété de sociétés américaines. Mozilla préconise la création d'une coalition internationale pour financer des modèles entièrement ouverts et neutres, citant en exemple le programme public suisse Apertus.
Pour les équipes de développement, la consigne est pragmatique : les modèles propriétaires ne valent la peine que si une échéance critique tombe avant que l'open source ne rattrape son retard, ou pour des tâches complexes nécessitant entre 8 et 12 heures de travail d'un expert. Pour le reste du code quotidien, les modèles ouverts offrent une alternative quasi équivalente pour 20 % du prix.