Les modèles chinois prennent les trois premières places d’OpenRouter
Le dernier classement hebdomadaire d'OpenRouter place trois modèles issus d'entreprises technologiques chinoises en tête de l'une des plus grandes vues publiques du trafic réel des développeurs entre plusieurs modèles. Selon le classement d'OpenRouter, DeepSeek V4 Flash 0731 a traité 11,4 billions de tokens sur la fenêtre hebdomadaire affichée, Tencent Hy3 9,22 billions et Xiaomi MiMo-V2.5 6,92 billions. GPT-5.6 Luna d'OpenAI suit avec 5,6 billions, tandis qu'une version antérieure de DeepSeek V4 Flash occupe la cinquième place avec 5,06 billions.
Le résultat est notable parce qu'il ne s'agit pas d'un tableau de benchmarks construit à partir de tests synthétiques. OpenRouter indique que ses classements reposent sur les tokens réellement traités via son API par des millions de développeurs, en comptant les tokens de prompt et de completion. Le dernier bucket complet de données est daté du 20 août 2026. Ce classement constitue donc un signal utile d'adoption dans l'écosystème OpenRouter, mais il ne faut pas le confondre avec une mesure de part de marché mondiale ou de qualité des modèles.
La concentration en tête du classement est aussi visible lorsque l'on isole les workloads de programmation. Le classement programmation d'OpenRouter place Xiaomi MiMo-V2.5 en première position avec 6,79 billions de tokens et 25,3 % de l'usage de code suivi, devant DeepSeek V4 Flash avec 3,51 billions et 13,1 %. GPT-5.6 Luna d'OpenAI est quatrième avec 8,2 %, tandis que Tencent Hy3 est sixième avec 5,7 %. Ces chiffres suggèrent que la force actuelle des modèles chinois ne vient pas seulement des usages de chat ou de divertissement.
Les usages orientés agents vont dans le même sens. Dans la collection tool calling d'OpenRouter, DeepSeek V4 Flash 0731 est le modèle le plus utilisé dans l'ensemble hebdomadaire suivi, avec environ 11,5 billions de tokens. Le tool calling est une brique centrale des agents qui interrogent des bases de données, appellent des API, exécutent des workflows et interagissent avec des systèmes externes. Un volume élevé dans cette catégorie est donc particulièrement pertinent pour les développeurs d'applications.
Une agrégation indépendante des données OpenRouter montre un mouvement similaire au niveau des fournisseurs. Tidelines estime DeepSeek à environ 25,7 % des tokens OpenRouter suivis au 20 août, contre 10,9 % pour Xiaomi, 10,3 % pour Tencent et 10,4 % pour OpenAI. Le service identifie aussi DeepSeek V4 Flash 0731 comme le plus grand gagnant sur trente jours, avec environ 13,6 points de pourcentage supplémentaires de part de tokens. Comme Tidelines dérive lui-même des données OpenRouter, il confirme la direction du mouvement sans mesurer indépendamment l'ensemble du marché mondial.
L'échelle d'OpenRouter rend cette évolution importante à surveiller. Reuters a indiqué cette semaine que la plateforme dessert plus de 10 millions de développeurs et d'entreprises, traite plus de 10 billions de tokens par jour et donne accès à des centaines de modèles d'IA. OpenRouter n'est qu'une passerelle parmi d'autres, mais sa taille est suffisante pour que les variations de trafic donnent une indication sur les modèles choisis par des développeurs capables de changer de fournisseur derrière une API commune.
Le coût fait probablement partie de l'explication, même si le classement ne peut pas établir de causalité. OpenRouter facilite le changement de modèle sans reconstruire une intégration, et des modèles open ou open-weight moins chers peuvent être attractifs pour les coding agents, le batch processing, les workflows riches en appels d'outils et les autres tâches où le volume de tokens augmente vite. DeepSeek, Tencent et Xiaomi positionnent leurs modèles récents autour d'un compromis entre capacité compétitive, grands contextes et coûts d'inférence inférieurs à de nombreuses offres frontier premium. Les données d'usage sont cohérentes avec cette hypothèse, mais ne révèlent pas pourquoi chaque utilisateur a choisi un modèle.
Cette limite est essentielle. OpenRouter précise que les classements mesurent l'adoption, pas l'accuracy, la qualité du reasoning ou les performances de benchmark. Le trafic privé est exclu. Les usages envoyés directement aux API d'OpenAI, Anthropic, Google, Tencent, DeepSeek ou d'autres fournisseurs sont invisibles. Le volume de tokens n'est pas non plus un nombre d'utilisateurs, de requêtes ou un montant de revenu. Les modèles diffèrent en tokenisation et en verbosité, si bien qu'un total de tokens supérieur ne signifie pas automatiquement davantage d'utilisateurs ou une préférence plus forte pour une tâche donnée.
La documentation de la Data API d'OpenRouter ajoute une autre réserve technique : les nombres de tokens proviennent du tokenizer de chaque fournisseur en amont. Un token rapporté par un fournisseur n'est donc pas parfaitement comparable à celui d'un autre. Le dataset public est utile pour l'analyse de tendance, mais il vaut mieux l'interpréter comme une télémétrie directionnelle que comme un recensement exact du marché.
Malgré ces contraintes, la composition du leaderboard est stratégiquement importante. Pendant une grande partie du cycle de l'IA générative, l'attention des développeurs hors de Chine s'est concentrée sur OpenAI, Anthropic et Google. Le trafic actuel d'OpenRouter montre que les développeurs utilisant une passerelle neutre dirigent désormais de très gros workloads, proches des usages de production, vers DeepSeek, Tencent et Xiaomi. La concurrence porte de plus en plus sur l'économie d'exploitation et l'adéquation à l'intégration, et pas seulement sur la première place d'un benchmark.
Pour les équipes engineering et product, la conclusion pratique est d'évaluer les modèles au niveau du workload au lieu de considérer un seul modèle flagship comme défaut permanent. Le coding, le tool calling, le traitement long contexte et l'automatisation à grand volume peuvent avoir des exigences différentes en coût, latence et qualité. Les données OpenRouter suggèrent que les développeurs arbitrent déjà activement ces compromis et que les modèles chinois sont devenus des options mainstream dans au moins un grand écosystème multi-provider.
Pour le marché plus large de l'IA, la prochaine question est de savoir si cette configuration persiste dans les prochaines fenêtres de données OpenRouter et si elle apparaît dans d'autres passerelles indépendantes et dans les données de déploiement d'entreprise. Un classement hebdomadaire peut changer rapidement après un lancement de modèle ou une modification de prix. Mais si DeepSeek, Tencent et Xiaomi restent proches du sommet pendant plusieurs semaines, il ne s'agira plus d'un classement temporaire : cela signalera un déplacement durable du centre de gravité des workloads IA des développeurs vers un marché plus global.
## Sources
- OpenRouter AI Model Rankings
- OpenRouter Programming Models
- OpenRouter Tool Calling Models
- OpenRouter Data API documentation
- Tidelines LLM usage tracker
- Reuters on OpenRouter scale and Stripe acquisition
Publié: