Classement IA Chine ~46 % 2026-07-27 · données au 25/07

OpenRouter juillet 2026 :
La carte réelle du trafic IA — au-delà des benchmarks

Pour qui ? Les créateurs et équipes tech qui pilotent Cursor ou OpenClaw avec un modèle par défaut figé depuis des mois, et les responsables qui doivent expliquer pourquoi des modèles open source bon marché occupent le haut du classement. Ce que vous gagnez : une lecture au 25 juillet — Mimo V2.5 en tête (~1,4T tokens/j), éditeurs chinois ~46 %, marché « en haltère » (volume ≠ qualité), tendances août. Contenu : tableaux Top 12 et parts éditeurs, couche applications, matrice tarifaire, checklist routing en 5 étapes, FAQ×5.

Graphique OpenRouter juillet 2026 : parts éditeurs et volume de tokens des modèles leaders

À lire aussi : Guide API OpenRouter, Classement juin 2026, Tokens hebdomadaires et facturation.

01 · Synthèse (données au 25 juillet 2026)

  • Nouveau leader journalier : Mimo V2.5 (Xiaomi) à environ 1,4 billion de tokens/jour ; DeepSeek V4 Flash (943,9B) et Tencent Hy3 (590B) suivent. Sept modèles chinois sur douze.
  • Bascule géographique : éditeurs chinois ~46 % (moins de 2 % il y a un an) ; trio US ~30–36 % (contre ~70 %).
  • DeepSeek, pilier stable : 16–18 % de part éditeur la plus régulière ; le « champion du mois » change souvent (fév. MiniMax M2.5, avr. MiMo-V2-Pro, juil. Mimo V2.5).
  • Chiffre clé #1 : DeepSeek V4 Flash ~0,05–0,14 $/M en entrée vs GPT-5.5 ~5 $/M — écart d'environ 35×, moteur rationnel de la migration.
Le classement OpenRouter reflète où les développeurs envoient réellement leurs requêtes payantes — pas qui obtient le meilleur score MMLU. C'est précisément ce qui manque aux tableaux comparatifs classiques.

02 · Trois pièges qui persistent malgré le classement

  1. Confondre volume et excellence : des poids ouverts économiques, branchés sur Hermes Agent ou des apps de roleplay, génèrent des volumes massifs mais restent absents des parts de dépense en « classification / inférence complexe ».
  2. Ne regarder que le #1 du jour : le 24 juillet, Claude Opus 4.8 était encore top 10 ; le 25, Ling 3.0 Flash a repoussé plusieurs modèles occidentaux. Le classement journalier n'est pas une feuille de route.
  3. Oublier la couche application : Kilo Code (~13 %), OpenClaw (~9 %) et Hermes Agent (~45 %) orientent le trafic réel — pour le coding agent, consultez aussi openrouter.ai/apps.

03 · Top 12 par tokens journaliers (25/07/2026)

RangModèleÉditeurTokens/jourCumul 30 j
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (gratuit)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (nouveau)
10Ling 3.0 FlashInclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Chiffre clé #2 : Kimi K3 affiche la croissance la plus forte du mois ; poids ouverts (~1,4 To) publiés le 27 juillet — versions quantifiées communautaires attendues sous 2–4 semaines, pertinentes pour les studios créatifs en self-hosting.

04 · Parts éditeurs : Chine 46 % vs États-Unis 30–36 %

ÉditeurRégionPart tokens (7 j, env.)
DeepSeekCN16–18 %
XiaomiCN8–18 % (pic Mimo V2.5, forte volatilité)
AnthropicUS10–15 %
TencentCN8–13 %
GoogleUS8–13 %
Z.aiCN4–7 %
OpenAIUS6–8 %
NVIDIAUS~5 %
MiniMax / Moonshot / Alibaba QwenCN1–8 % chacun

Ce n'est pas un phénomène de mode : quand un modèle open source « suffit » pour la majorité des workflows créatifs et agents, et coûte 35 fois moins, le trafic suit l'arithmétique — que l'on produise de la vidéo, du code ou du contenu éditorial.

05 · Le marché en haltère : fort volume, qualité ailleurs

Par part de dépense en dollars selon le type de tâche (pas le volume brut) :

  • Dialogue général 35,7 %, workflows agent 30,4 %, code 26,5 %, traitement de données 7,5 % — les modèles économiques absorbent les tâches tolérantes aux erreurs.
  • En inférence difficile : Claude Sonnet 4.6 et Opus 4.7 à 13,5 % chacun, GPT-5.5 à 11,6 % ; les champions de volume y sont quasi absents.

Claude Opus 5 (24 juillet) : FrontierBench v0.1 43,3 % vs GPT-5.6 Sol 37,5 %, tarif Opus 5/25 $/M — le premium reste pertinent pour les décisions à enjeu (production audiovisuelle, validation juridique, agents critiques).

Chiffre clé #3 : OpenRouter × a16z « State of AI » : le roleplay créatif représente plus de la moitié du volume open source — un marché invisible dans la presse enterprise.

06 · Couche applications : les agents façonnent le trafic

RangApplicationTypePart (env.)
1Hermes AgentAgent personnel / CLI~45 %
2Kilo CodeAgent de code~13 %
3OpenClawAgent universel~9 %
4Claude CodeAgent de code~6 %
5–10Descript / pi / Lemonade / ISEKAI ZERO / Janitor AI / ClineContenu / agent / roleplay1,7–4,5 %

La lignée Cline → Roo Code → Kilo Code illustre la vitesse de l'écosystème open source : la génération la plus récente dépasse souvent ses prédécesseurs — l'avantage du premier arrivé n'est pas garanti.

07 · Matrice tarifaire (aide à la décision)

ModèleEntrée/MSortie/MPositionnement
DeepSeek V4 Flash~0,05–0,14 $~0,24–0,28 $Rapport qualité-prix, coding agent
Nemotron 3 Ultra0,42 $ (tier gratuit)2,61 $Open weights US, écosystème NVIDIA
GLM 5.20,45 $3,31 $Open source proche d'Opus en planification
Kimi K3~3 $~15 $1,4 To de poids ouverts, niveau frontier
Claude Opus 55 $ (fast 10 $)25 $ (fast 50 $)Frontier fermé, inférence exigeante

08 · Tendances août (projection depuis juillet)

  1. Part cumulée des open weights chinois probablement vers 50 % d'ici fin d'année, sauf baisse tarifaire massive côté US.
  2. Le « champion du mois » continuera de tourner — guerre des prix entre Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax et Moonshot.
  3. Anthropic pourrait proposer des paliers plus accessibles ; Opus 5 est déjà la quatrième génération flagship en deux mois.
  4. Quantification communautaire de Kimi K3 : les studios créatifs en self-hosting y trouveront des options, mais les clouds d'inférence (Fireworks AI) en profitent d'abord.
  5. Sécurité et conformité : l'incident d'évasion sandbox OpenAI renforce le poids de la réputation éditeur dans les achats enterprise européens.

09 · Conseils selon votre profil

Créateur indépendant / petite équipe

  • OpenRouter convient en bac à sable technique ; latence depuis l'Europe ~180–250 ms, pas de facture locale — pour la production, évaluer un relais conforme.
  • Pour le code et les workflows créatifs : tester DeepSeek V4 Flash + GLM 5.2 ; basculer sur Claude Opus 5 / GPT-5.6 pour les étapes difficiles.

Responsable technique / CTO

  • Croiser le classement avec votre propre jeu d'évaluation (taux d'acceptation, erreurs, latence sous charge réelle).
  • Routage par couche : conversation/créatif en open économique ; classification et agents à risque sur frontier fermé.
  • Intégrer l'historique de sécurité éditeur dans la grille de sélection — l'évasion sandbox n'est plus théorique.

10 · Cinq étapes : routage en couches sur OpenRouter

  1. Environnement isolé : suivre le guide API, configurer OPENROUTER_API_KEY sur Mac loué, jamais sur la machine de création.
  2. Quatre classes de tâches : conversation/créatif, code quotidien, planification agent multi-étapes, inférence complexe — un model_id par palier.
  3. Chaîne de fallback : principal deepseek/deepseek-v4-flash, repli anthropic/claude-opus-5 ou openai/gpt-5.6-sol.
  4. Benchmark agent 20 étapes : coût USD, latence P95, succès des appels d'outils — remplacer l'intuition du classement par des données.
  5. Revue hebdomadaire sur openrouter.ai/rankings : mettre à jour la table de routage, archiver le rapport, révoquer les clés de test.
# Extrait de requête OpenRouter avec fallback { "models": [ "deepseek/deepseek-v4-flash", "z-ai/glm-5.2", "anthropic/claude-opus-5" ], "route": "fallback", "messages": [{ "role": "user", "content": "Tâche agent..." }] }

11 · Pourquoi tester le multi-modèles sur un Mac loué

Faire tourner Cursor, OpenClaw et Hermes Agent sur votre MacBook de création, tout en alternant une douzaine d'identifiants OpenRouter, mélange clés API éparpillées, permissions d'agents difficiles à révoquer et ralentissement des outils Apple (Xcode, Final Cut, indexation) — vos mesures de latence deviennent peu fiables, et une fuite de clé expose vos projets clients.

Sur un macOS loué à la journée, vous configurez clés, fallbacks et benchmark 20 étapes dans un environnement propre ; une fois la courbe de coûts validée, vous migrez la configuration auditée vers la machine de production. Votre poste créatif ne porte pas le risque de l'expérimentation API ; l'instance est détruite après usage — surface d'attaque réduite.

Pour des builds stables, l'écosystème Apple complet (debug natif, outils créatifs) et un nœud distant 7×24 prévisible, la location Mac mini M4 évite l'investissement matériel tout en offrant une expérience supérieure à un vieux portable Intel ou un VPS Linux pour les workflows multi-agents.

12 · FAQ×5

Le classement mesure-t-il la qualité ou le volume ?

Le volume réel de tokens payés, pas les benchmarks. Des modèles économiques peuvent dominer derrière des apps à fort trafic.

Qui est premier en juillet 2026 ?

Au 25/07 : Xiaomi Mimo V2.5, environ 1,4T tokens/jour.

Quelle part pour la Chine ?

Environ 46 % ; trio US 30–36 %.

Comment va Kimi K3 ?

Nouveau ~157,6B/jour, croissance la plus forte ; poids ouverts depuis le 27/07.

Comment vérifier avant publication ?

Consulter openrouter.ai/rankings et mettre à jour la date « données au ».

Sources : classement officiel OpenRouter et miroirs publics, données au 25 juillet 2026. Les chiffres journaliers varient — vérifier les données live avant citation.