Classement OpenRouter juillet 2026
Mimo V2.5 en tête, modèles chinois ~46% — Qui gagne la guerre du trafic IA ?

Si vous choisissez encore vos modèles selon des benchmarks vieux de plusieurs mois, le trafic payant réel d'OpenRouter (au 25 juillet 2026) change la donne : Xiaomi Mimo V2.5 mène avec 1,4 billion de tokens/jour, les fournisseurs chinois totalisent ~46 % (moins de 2 % il y a un an), et les labs américains sont passés de ~70 % à 30–36 %. Ce guide professionnel détaille le Top 12, les parts par fournisseur, usage ≠ qualité, la couche applicative (Hermes Agent ~45 %), un comparatif tarifaire, les perspectives d'août et une checklist en six étapes pour le routage multi-modèles.

01

Pourquoi la première place de juillet 2026 ne suffit plus au choix du modèle

Le classement OpenRouter reflète le volume de tokens réellement payé — le vote des portefeuilles, pas le marketing éditeur. La liste évolue vite (Mimo V2.5 a modifié le Top 10 entre le 24 et le 25 juillet). Erreurs fréquentes :

  1. 01

    Confondre MMLU et production : Les benchmarks mesurent le plafond ; OpenRouter mesure les habitudes de facturation. Les modèles bon marché dominent le trafic même si l'inférence complexe est moyenne.

  2. 02

    Ignorer usage ≠ qualité : Les leaders volume sont absents en « classification/inférence complexe » ; Claude Sonnet 4.6 et Claude Opus 4.7 partagent chacun 13,5 % des dépenses.

  3. 03

    Ne regarder que la couche modèle : openrouter.ai/apps place Hermes Agent à ~45 % des tokens applicatifs ; le roleplay représente une part majeure de l'open source, invisible dans la presse enterprise.

  4. 04

    Prendre le #1 instantané pour un leader durable : DeepSeek reste stable (~16–18 %), mais les champions mensuels tournent (MiniMax M2.5, MiMo-V2-Pro, Mimo V2.5).

  5. 05

    Sous-estimer l'écart de prix (×35) : DeepSeek V4 Flash ~0,05–0,14 $/M vs GPT-5.5 ~5 $/M — les équipes rationnelles routent par coût.

  6. 06

    Négliger sécurité et conformité : Évasion sandbox OpenAI, projet de loi « AI kill switch » au Congrès américain — la réputation fournisseur pèse davantage en production Agent.

« Capability et popularity divergent — mieux vaut une architecture de routage par paliers qu'une obsession du numéro un. »

02

Classement de juillet : Xiaomi #1, modèles chinois ~46 %

Données au 25 juillet 2026 (vérifier openrouter.ai/rankings avant mise en production). Top 3 : Mimo V2.5 (1,4T/j), DeepSeek V4 Flash (943,9B/j), Tencent Hy3 (590B/j). Sept modèles sur douze sont chinois.

Top 12 modèles par volume journalier

RangModèleFournisseurTokens/jourCumul 30 j
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (gratuit)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (nouveau)
10Ling 3.0 FlashAnt/InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Parts fournisseurs (agrégé, fenêtre 7 jours, arrondi)

FournisseurRégionPart tokens (env.)
DeepSeekCN16–18 % (stable #1)
XiaomiCN8–18 % (bond Mimo V2.5, volatile)
AnthropicUS10–15 %
TencentCN8–13 %
GoogleUS8–13 %
Z.aiCN4–7 %
OpenAIUS6–8 %

Total chinois ~46 %, total US 30–36 % (contre ~70 % il y a un an). Comparaison mensuelle : analyse de juin (61 %) — fenêtres de mesure différentes.

info

Chiffres citables : ① Mimo V2.5 1,4T/j (25.7.). ② DeepSeek 16–18 % de part. ③ Inversion CN/US ~40 points en 12 mois.

03

L'autre face du classement : volume élevé ≠ qualité — marché en haltère

Par part de dépenses (pas volume tokens) sur OpenRouter : dialogue général 35,7 %, workflows Agent 30,4 %, code 26,5 %, traitement de données 7,5 %. En « classification/inférence complexe » :

DimensionScénarios volume (open source abordable)Scénarios difficiles (frontier fermé)
Tâches typiquesChat, création, roleplay, aide code simpleInférence complexe, planification Agent enterprise, classification stricte
Leaders dépensesMimo V2.5, V4 Flash, Hy3, etc.Claude Sonnet 4.6 / Opus 4.7 à 13,5 % chacun ; GPT-5.5 11,6 %
Logique tarifaireJusqu'à ×35 moins cher, forte tolérance aux erreursOpus 5 à 5 $/25 $, FrontierBench v0.1 43,3 %

Le 24 juillet, Anthropic a lancé Claude Opus 5 : FrontierBench v0.1 43,3 % (GPT-5.6 Sol 37,5 %), tarif inchangé 5 $/25 $. Voir Opus 5 et controverse Kimi K3.

warning

Recommandation architecture : frontier fermé pour les 5–10 % les plus difficiles, open source chinois pour 90 %+ du trafic de masse — pas un duel binaire « qui est le plus fort ».

04

Couche applicative : agents code et roleplay invisible

Le classement modèles montre les « cerveaux » populaires ; la couche apps montre leur usage réel :

RangApplicationTypePart (env.)
1Hermes AgentAgent personnel / CLI~45 %
2Kilo CodeAgent code~13 %
3OpenClawAgent généraliste~9 %
4Claude CodeAgent code~6 %
5DescriptProduction contenu~4,5 %
7–9Lemonade / ISEKAI ZERO / Janitor AICompagnie / roleplay (nouveaux)~2 % chacun
10ClineAgent code (IDE)~1,7 %

Cline → Roo Code → Kilo Code partagent une lignée ; Kilo dépasse désormais Cline. OpenRouter × a16z « State of AI » : le roleplay créatif représente plus de la moitié du trafic open source — absent des médias enterprise.

05

Perspectives août, comparatif tarifaire et paramètres citables

Scénarios août 2026 et positionnement tarifaire (suite logique du guide d'intégration OpenRouter) :

ModèleInput/MOutput/MPositionnement
DeepSeek V4 Flash~0,05–0,14 $~0,24–0,28 $Rapport qualité-prix, coding agentique
MiniMax M30,10 $1,21 $Long contexte / multimodal budget
GLM 5.20,45 $3,31 $Open weight proche d'Opus en planification
Kimi K3~3 $~15 $1,4 To open weights, niveau closed
Claude Opus 55 $ (fast 10 $)25 $ (fast 50 $)Frontier fermé, sommet benchmarks juillet
  • Part de marché : open source chinois probablement > 50 % en 2026 sans baisse majeure US.
  • Rotation des champions : le #1 mensuel continuera de changer — surveiller les releases d'août.
  • Quantification Kimi K3 : versions communautaires des poids 1,4 To sous 2–4 semaines.
  • Conformité : réputation sécurité fournisseur et RGPD pèsent davantage en achat enterprise.
06

Routage en six étapes et recommandations par profil

Développeurs indépendants : OpenRouter comme bac à sable ; tester DeepSeek V4 Flash et GLM 5.2 pour le code, réserver Opus 5 / GPT-5.6 aux étapes bloquées. Latence depuis l'UE ~180–250 ms — relais conforme en production si besoin.

Responsables techniques : ne pas acheter selon le classement volume ; définir des paliers par scénario et intégrer la réputation sécurité à la grille de sélection.

Checklist en six étapes

  1. 01

    Consulter openrouter.ai/rankings chaque semaine : Top 12 et parts fournisseurs, date de référence notée.

  2. 02

    Règles gateway par scénario : chat/créatif → V4 Flash / Mimo V2.5 ; inférence complexe → Claude Opus 5 ; classification sensible → Sonnet 4.6 / Opus 4.7.

  3. 03

    Séparer facture tokens et facture USD : beaucoup de Flash + forte part Claude en dollars = tiering actif — formaliser la table de routage.

  4. 04

    Suivre la couche apps : agents code (Kilo Code, Claude Code) vs roleplay — choisir le modèle selon le produit.

  5. 05

    Jeu de régression pour août : nouveau Top 1 évalué sous 48 h sur le même bench — mettre à jour la config, pas l'application.

  6. 06

    Fixer la couche d'exécution Agent : sessions CLI longues et prefill sensibles sur Mac SSH dédié ; OpenRouter pour les pics. Specs : tarifs location.

Un laptop endormi ou un VPS Linux bas de gamme peine sur des boucles Agent de 12 h+ ; xcodebuild et notarytool exigent macOS. Pour des sessions SSH stables, isolation Keychain et bande passante prévisible en CI/CD iOS et automation Agent, associer la gateway OpenRouter à un Mac cloud dédié est plus maîtrisable qu'une stack 100 % API publique. Les contournements VPS souffrent de latence et d'une chaîne Metal incomplète — pour la production, NodeMini location Mac Mini cloud offre des nœuds fixes et des coûts planifiés : changement de clé API sans refonte CI. Tarifs : tarifs location, onboarding : centre d'aide.

FAQ

Questions fréquentes

Au 25 juillet 2026 : Xiaomi Mimo V2.5 (~1,4T/j), puis DeepSeek V4 Flash (943,9B/j) et Tencent Hy3 (590B/j). Variations quotidiennes — données live : openrouter.ai/rankings.

Non — fenêtres différentes (7 j fournisseurs vs total incl. gratuit), trafic apps et sources. L'essentiel : <2 % → ~46 % en 12 mois. Voir analyse de juin.

OpenRouter pour le routage multi-modèles et la facturation ; agents CLI longue durée et prefill local sur Mac SSH exclusif à coût mensuel fixe. Configuration : centre d'aide, specs : tarifs location.

① Open source chinois > 50 % ? ② Offre Anthropic plus abordable ? ③ Quantification Kimi K3. ④ Législation sécurité IA US et achats enterprise.