OpenRouter июль 2026: Mimo V2.5 на первом месте
Китайские модели ~46% — кто выигрывает войну за AI-трафик?

Если вы выбираете LLM по benchmark'ам несколькемесячной давности, реальный платный трафик OpenRouter (срез 25 июля 2026) меняет картину: Xiaomi Mimo V2.51,4T tokens/день, китайские провайдеры суммарно ~46% (год назад <2%), US labs упали с ~70% до 30–36%. Технический разбор: Top-12, доли провайдеров, usage ≠ quality, app layer (Hermes Agent ~45%), price matrix, прогноз на август и 6-шаговый tier-routing checklist для multi-model gateway.

01

Почему #1 в июле 2026 недостаточен для model selection

OpenRouter rankings сортирует по реальному paid token volume — wallet voting, не vendor marketing. Список меняется ежедневно (Mimo V2.5 переставил Top-10 между 24 и 25 июля). Типичные ошибки:

  1. 01

    MMLU как production KPI: Benchmarks измеряют ceiling; OpenRouter — billing habits. Дешёвые Flash-модели доминируют в traffic даже при средней complex inference.

  2. 02

    Игнорировать usage ≠ quality: Volume leaders почти отсутствуют в «classification/complex reasoning»; Claude Sonnet 4.6 и Claude Opus 4.7 — по 13,5% spend share каждый.

  3. 03

    Смотреть только model layer: openrouter.ai/appsHermes Agent ~45% app tokens; roleplay apps держат значимую долю open-source traffic, невидимую в enterprise media.

  4. 04

    Краткосрочный #1 как long-term leader: DeepSeek стабилен (~16–18% provider share), но monthly champions ротируются (MiniMax M2.5, MiMo-V2-Pro, Mimo V2.5).

  5. 05

    35× price spread: DeepSeek V4 Flash ~$0.05–0.14/M input vs GPT-5.5 ~$5/M — рациональные команды route по cost, не prestige.

  6. 06

    Security reputation off scorecard: OpenAI sandbox escape reports, US Congress «AI kill switch» bill — в Agent production растёт вес vendor security track record.

«Capability и popularity расходятся — tier routing architecture важнее, чем погоня за #1.»

02

Июльский рейтинг: Xiaomi #1, китайские модели ~46%

Data cutoff 25 июля 2026 (перед deploy проверьте openrouter.ai/rankings). Top 3: Mimo V2.5 (1,4T/день), DeepSeek V4 Flash (943,9B/день), Tencent Hy3 (590B/день). 7 из Top-12 — китайские модели.

Top-12 моделей по daily token volume

RankModelVendorTokens/день30d cumulative
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (free)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (new)
10Ling 3.0 FlashAnt/InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Provider share (aggregated 7-day window, rounded)

ProviderRegionToken share (approx.)
DeepSeekCN16–18% (stable #1)
XiaomiCN8–18% (Mimo V2.5 spike, volatile)
AnthropicUS10–15%
TencentCN8–13%
GoogleUS8–13%
Z.aiCN4–7%
OpenAIUS6–8%

CN providers total ~46%, US total 30–36% (year ago ~70%). MoM compare: июньский разбор (61%) — разные measurement windows.

info

Citable metrics: ① Mimo V2.5 1,4T/день (25.7.). ② DeepSeek 16–18% provider share. ③ CN/US reversal ~40 pp за 12 месяцев.

03

Обратная сторона рейтинга: high volume ≠ high quality — dumbbell market

По spend share (не token count) на OpenRouter: general dialogue 35,7%, Agent workflows 30,4%, code 26,5%, data processing 7,5%. В «classification/complex reasoning»:

DimensionVolume scenarios (cheap open weights)Hard tasks (closed frontier)
Typical tasksChat, creative writing, roleplay, simple coding assistComplex reasoning, enterprise Agent planning, strict classification
Spend leadersMimo V2.5, V4 Flash, Hy3, etc.Claude Sonnet 4.6 / Opus 4.7 по 13,5%; GPT-5.5 11,6%
Pricing logicДо 35× дешевле, high error toleranceOpus 5 at $5/$25, FrontierBench v0.1 43,3%

24 июля Anthropic выпустила Claude Opus 5: FrontierBench v0.1 43,3% (GPT-5.6 Sol 37,5%), pricing unchanged $5/$25. Подробнее: Opus 5 и Kimi K3 controversy.

warning

Architecture takeaway: closed frontier на hardest 5–10% tasks, CN open weights на 90%+ bulk traffic — не binary «кто сильнее».

04

App layer: coding agents и invisible roleplay half

Model rankings — popular «brains»; app layer — реальное использование:

RankAppTypeShare (approx.)
1Hermes AgentPersonal agent / CLI~45%
2Kilo CodeCoding agent~13%
3OpenClawGeneral agent~9%
4Claude CodeCoding agent~6%
5DescriptContent production~4,5%
7–9Lemonade / ISEKAI ZERO / Janitor AICompanion / roleplay (new)~2% each
10ClineCoding agent (IDE)~1,7%

Cline → Roo Code → Kilo Code — одна code lineage; Kilo уже обгоняет Cline. OpenRouter × a16z «State of AI»: creative roleplay — больше половины open-source usage, почти не видно в enterprise coverage.

05

August outlook, price matrix и citable params

Прогноз на август 2026 + price positioning (продолжение OpenRouter integration guide):

ModelInput/MOutput/MPositioning
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28Price/performance king, agentic coding
MiniMax M3$0.10$1.21Long context / multimodal budget
GLM 5.2$0.45$3.31Open weight near Opus planning quality
Kimi K3~$3~$151,4TB open weights, closed-tier capability
Claude Opus 5$5 (fast $10)$25 (fast $50)Closed frontier, July benchmark peak
  • Share forecast: CN open source likely > 50% in 2026 без major US price cuts.
  • Champion rotation: monthly #1 продолжит меняться — следите за August releases.
  • Kimi K3 quantization: community builds 1,4TB weights за 2–4 недели.
  • Security/compliance: vendor security reputation растёт в enterprise procurement.
06

6-step tier routing и рекомендации по ролям

Indie developers: OpenRouter как sandbox — ок; coding сначала на DeepSeek V4 Flash и GLM 5.2, Opus 5 / GPT-5.6 только для blocked steps. Latency из EU ~180–250 ms — в production оцените compliant relay.

Enterprise tech leads: не закупайте по volume rank; определите task tiers и включите vendor security record в selection scorecard.

6-step production checklist

  1. 01

    Weekly openrouter.ai/rankings audit: Top-12 и provider shares, фиксируйте data cutoff date.

  2. 02

    Gateway rules по scenario: chat/creative → V4 Flash / Mimo V2.5; complex reasoning → Claude Opus 5; high-risk classification → Sonnet 4.6 / Opus 4.7.

  3. 03

    Split token bill vs USD bill: много Flash tokens + высокий Claude USD = tiering работает — formalize routing table.

  4. 04

    Track app layer: coding agents (Kilo Code, Claude Code) vs roleplay — model choice привязан к product context.

  5. 05

    Regression set для августа: новый Top-1 — eval за 48h на том же bench, update config not app rewrite.

  6. 06

    Fix Agent execution layer: long CLI sessions и sensitive prefill на dedicated SSH Mac; OpenRouter только для elastic peaks. Specs: цены аренды.

Sleeping laptop или cheap Linux VPS плохо держит 12h+ Agent loops; xcodebuild и notarytool требуют macOS. Для stable SSH sessions, Keychain isolation и predictable bandwidth в iOS CI/CD и Agent automation — OpenRouter gateway + dedicated cloud Mac предсказуемее, чем 100% public API. VPS workarounds страдают от latency и incomplete Metal chain — для production NodeMini Mac Mini cloud rental даёт fixed nodes и planned costs: смена API key без CI rebuild. Onboarding: help center, specs: цены аренды.

FAQ

Частые вопросы

На 25 июля 2026: Xiaomi Mimo V2.5 (~1,4T/день), затем DeepSeek V4 Flash (943,9B/день) и Tencent Hy3 (590B/день). Daily variance — live data: openrouter.ai/rankings.

Нет — разные windows (7-day provider vs total incl. free tier), app traffic и sources. Ключевое: <2% → ~46% за 12 месяцев. Сравните июньский разбор.

OpenRouter — multi-model routing и billing; long CLI agents и local prefill на SSH-exclusive Mac с fixed monthly cost. Setup: help center, specs: цены аренды.

① CN open source > 50%? ② Более доступный Anthropic tier? ③ Kimi K3 community quantization. ④ US AI security legislation и enterprise procurement.