Если вы выбираете LLM по benchmark'ам несколькемесячной давности, реальный платный трафик OpenRouter (срез 25 июля 2026) меняет картину: Xiaomi Mimo V2.5 — 1,4T tokens/день, китайские провайдеры суммарно ~46% (год назад <2%), US labs упали с ~70% до 30–36%. Технический разбор: Top-12, доли провайдеров, usage ≠ quality, app layer (Hermes Agent ~45%), price matrix, прогноз на август и 6-шаговый tier-routing checklist для multi-model gateway.
OpenRouter rankings сортирует по реальному paid token volume — wallet voting, не vendor marketing. Список меняется ежедневно (Mimo V2.5 переставил Top-10 между 24 и 25 июля). Типичные ошибки:
MMLU как production KPI: Benchmarks измеряют ceiling; OpenRouter — billing habits. Дешёвые Flash-модели доминируют в traffic даже при средней complex inference.
Игнорировать usage ≠ quality: Volume leaders почти отсутствуют в «classification/complex reasoning»; Claude Sonnet 4.6 и Claude Opus 4.7 — по 13,5% spend share каждый.
Смотреть только model layer: openrouter.ai/apps — Hermes Agent ~45% app tokens; roleplay apps держат значимую долю open-source traffic, невидимую в enterprise media.
Краткосрочный #1 как long-term leader: DeepSeek стабилен (~16–18% provider share), но monthly champions ротируются (MiniMax M2.5, MiMo-V2-Pro, Mimo V2.5).
35× price spread: DeepSeek V4 Flash ~$0.05–0.14/M input vs GPT-5.5 ~$5/M — рациональные команды route по cost, не prestige.
Security reputation off scorecard: OpenAI sandbox escape reports, US Congress «AI kill switch» bill — в Agent production растёт вес vendor security track record.
«Capability и popularity расходятся — tier routing architecture важнее, чем погоня за #1.»
Data cutoff 25 июля 2026 (перед deploy проверьте openrouter.ai/rankings). Top 3: Mimo V2.5 (1,4T/день), DeepSeek V4 Flash (943,9B/день), Tencent Hy3 (590B/день). 7 из Top-12 — китайские модели.
| Rank | Model | Vendor | Tokens/день | 30d cumulative |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (free) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot | 157,6B | 1,6T (new) |
| 10 | Ling 3.0 Flash | Ant/InclusionAI | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
| Provider | Region | Token share (approx.) |
|---|---|---|
| DeepSeek | CN | 16–18% (stable #1) |
| Xiaomi | CN | 8–18% (Mimo V2.5 spike, volatile) |
| Anthropic | US | 10–15% |
| Tencent | CN | 8–13% |
| US | 8–13% | |
| Z.ai | CN | 4–7% |
| OpenAI | US | 6–8% |
CN providers total ~46%, US total 30–36% (year ago ~70%). MoM compare: июньский разбор (61%) — разные measurement windows.
Citable metrics: ① Mimo V2.5 1,4T/день (25.7.). ② DeepSeek 16–18% provider share. ③ CN/US reversal ~40 pp за 12 месяцев.
По spend share (не token count) на OpenRouter: general dialogue 35,7%, Agent workflows 30,4%, code 26,5%, data processing 7,5%. В «classification/complex reasoning»:
| Dimension | Volume scenarios (cheap open weights) | Hard tasks (closed frontier) |
|---|---|---|
| Typical tasks | Chat, creative writing, roleplay, simple coding assist | Complex reasoning, enterprise Agent planning, strict classification |
| Spend leaders | Mimo V2.5, V4 Flash, Hy3, etc. | Claude Sonnet 4.6 / Opus 4.7 по 13,5%; GPT-5.5 11,6% |
| Pricing logic | До 35× дешевле, high error tolerance | Opus 5 at $5/$25, FrontierBench v0.1 43,3% |
24 июля Anthropic выпустила Claude Opus 5: FrontierBench v0.1 43,3% (GPT-5.6 Sol 37,5%), pricing unchanged $5/$25. Подробнее: Opus 5 и Kimi K3 controversy.
Architecture takeaway: closed frontier на hardest 5–10% tasks, CN open weights на 90%+ bulk traffic — не binary «кто сильнее».
Model rankings — popular «brains»; app layer — реальное использование:
| Rank | App | Type | Share (approx.) |
|---|---|---|---|
| 1 | Hermes Agent | Personal agent / CLI | ~45% |
| 2 | Kilo Code | Coding agent | ~13% |
| 3 | OpenClaw | General agent | ~9% |
| 4 | Claude Code | Coding agent | ~6% |
| 5 | Descript | Content production | ~4,5% |
| 7–9 | Lemonade / ISEKAI ZERO / Janitor AI | Companion / roleplay (new) | ~2% each |
| 10 | Cline | Coding agent (IDE) | ~1,7% |
Cline → Roo Code → Kilo Code — одна code lineage; Kilo уже обгоняет Cline. OpenRouter × a16z «State of AI»: creative roleplay — больше половины open-source usage, почти не видно в enterprise coverage.
Прогноз на август 2026 + price positioning (продолжение OpenRouter integration guide):
| Model | Input/M | Output/M | Positioning |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | Price/performance king, agentic coding |
| MiniMax M3 | $0.10 | $1.21 | Long context / multimodal budget |
| GLM 5.2 | $0.45 | $3.31 | Open weight near Opus planning quality |
| Kimi K3 | ~$3 | ~$15 | 1,4TB open weights, closed-tier capability |
| Claude Opus 5 | $5 (fast $10) | $25 (fast $50) | Closed frontier, July benchmark peak |
Indie developers: OpenRouter как sandbox — ок; coding сначала на DeepSeek V4 Flash и GLM 5.2, Opus 5 / GPT-5.6 только для blocked steps. Latency из EU ~180–250 ms — в production оцените compliant relay.
Enterprise tech leads: не закупайте по volume rank; определите task tiers и включите vendor security record в selection scorecard.
Weekly openrouter.ai/rankings audit: Top-12 и provider shares, фиксируйте data cutoff date.
Gateway rules по scenario: chat/creative → V4 Flash / Mimo V2.5; complex reasoning → Claude Opus 5; high-risk classification → Sonnet 4.6 / Opus 4.7.
Split token bill vs USD bill: много Flash tokens + высокий Claude USD = tiering работает — formalize routing table.
Track app layer: coding agents (Kilo Code, Claude Code) vs roleplay — model choice привязан к product context.
Regression set для августа: новый Top-1 — eval за 48h на том же bench, update config not app rewrite.
Fix Agent execution layer: long CLI sessions и sensitive prefill на dedicated SSH Mac; OpenRouter только для elastic peaks. Specs: цены аренды.
Sleeping laptop или cheap Linux VPS плохо держит 12h+ Agent loops; xcodebuild и notarytool требуют macOS. Для stable SSH sessions, Keychain isolation и predictable bandwidth в iOS CI/CD и Agent automation — OpenRouter gateway + dedicated cloud Mac предсказуемее, чем 100% public API. VPS workarounds страдают от latency и incomplete Metal chain — для production NodeMini Mac Mini cloud rental даёт fixed nodes и planned costs: смена API key без CI rebuild. Onboarding: help center, specs: цены аренды.
На 25 июля 2026: Xiaomi Mimo V2.5 (~1,4T/день), затем DeepSeek V4 Flash (943,9B/день) и Tencent Hy3 (590B/день). Daily variance — live data: openrouter.ai/rankings.
Нет — разные windows (7-day provider vs total incl. free tier), app traffic и sources. Ключевое: <2% → ~46% за 12 месяцев. Сравните июньский разбор.
OpenRouter — multi-model routing и billing; long CLI agents и local prefill на SSH-exclusive Mac с fixed monthly cost. Setup: help center, specs: цены аренды.
① CN open source > 50%? ② Более доступный Anthropic tier? ③ Kimi K3 community quantization. ④ US AI security legislation и enterprise procurement.