数ヶ月前の印象で「どの LLM が最も使う価値があるか」を判断しているなら、OpenRouter 2026年7月25日時点の実際の有料トラフィックが認識を覆します。小米 Mimo V2.5 が1日 1.4 兆 Token で首位、中国ベンダー合計シェア約 46%(1年前は 2% 未満)、米国三巨頭は約 70% から 30%–36% に滑落しました。本記事はマルチモデルルーティングを構築する開発者と技術責任者向けに、Top 12 モデル、ベンダーシェア、使用量≠品質、アプリ層 Agent、価格対照、8月トレンドを解説し、6ステップ階層ルーティング実装チェックリストを提示します。
OpenRouter ランキングは実 Token 使用量で並べ替えます——本質的に開発者が実際にお金を払って使っているモデルであり、ベンチマーク最高点ではありません。7月の榜单は変動が激しく(Mimo V2.5 は 7/24 から 7/25 で Top 10 の順序が変化)、旧来の選定フレームワークを使い続けると次の落とし穴に陥ります:
MMLU を本番指標にする:Benchmark は上限を測り、OpenRouter は請求習慣を測ります。安くて速いモデルが高トラフィックアプリに載れば榜一も容易——複雑推論は平凡でも。
「使用量≠品質」を無視する:総量榜を占める廉価オープンソースモデルは「分類/複雑推論」消費次元ではほぼ見えません。Claude Sonnet 4.6 と Claude Opus 4.7 が各 13.5% の消費シェアで並び1位です。
モデル層だけ見てアプリ層を見ない:openrouter.ai/apps では Hermes Agent がアプリ Token の約 45% を独占。ロールプレイ系アプリがオープンソース流量の相当割合を占め、企業向け報道では見えません。
瞬間的 #1 を長期リードと誤認:DeepSeek のベンダーシェアが最も安定(約 16%–18%)ですが、「月間チャンピオンモデル」は MiniMax M2.5、MiMo-V2-Pro から Mimo V2.5 まで頻繁に交代——中国陣営内部の競争も激しいです。
35倍の価格差を無視:DeepSeek V4 Flash 入力約 $0.05–0.14/M、GPT-5.5 約 $5/M——オープンソースモデルが「十分使える」なら、合理的な開発者は自然とそちらを選びます。
安全評判をスコアカードに入れない:今週 OpenAI のモデルサンドボックス脱出未公開、米国議会「AI キルスイッチ法案」推進——企業 Agent シーンでは「ベンダーの安全記録」の重みが明らかに上がります。
「capability(能力)と popularity(使用量)は乖離しつつある——誰が1位かより、階層ルーティング戦略を構築する方が価値がある。」
データは 2026年7月25日 時点(公開前は openrouter.ai/rankings のリアルタイム榜单を確認してください)。トップ3:小米 Mimo V2.5(1.4T/日)、DeepSeek V4 Flash(943.9B/日)、腾讯 Hy3(590B/日)。Top 12 のうち中国ベンダーモデルが7席を占めます。
| 順位 | モデル | ベンダー | 1日 Token | 直近30日累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(無料) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新規上榜) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
| ベンダー | 所属 | Token シェア(概) |
|---|---|---|
| DeepSeek | 中国 | 16%–18%(多くの統計で第1) |
| 小米 | 中国 | 8%–18%(Mimo V2.5 急増、変動最大) |
| Anthropic | 米国 | 10%–15% |
| 腾讯 | 中国 | 8%–13% |
| 米国 | 8%–13% | |
| 智譜 Z.ai | 中国 | 4%–7% |
| OpenAI | 米国 | 6%–8% |
中国ベンダー合計約 46%、米国ベンダー合計約 30%–36%(1年前は約 70%)。6月 OpenRouter ランキング分析と対照して月次変化を確認できます。
引用可能なハードデータ:① Mimo V2.5 日量 1.4T、7/25 単品1位。② DeepSeek ベンダーシェア 16%–18%、最も安定した第1。③ 米中シェアが1年で約 40 ポイント逆転。
OpenRouter がタスクタイプ別に集計する消費金額占比(Token 量ではなく)は全く異なる図を描きます:汎用対話 35.7%、Agent ワークフロー 30.4%、コード 26.5%、データ処理 7.5%。「分類/複雑推論」に絞ると:
| 次元 | 大量処理シーン(廉価 OSS 主導) | 高難度シーン(クローズド旗艦主導) |
|---|---|---|
| 典型タスク | 雑談、創作、ロールプレイ、簡単なコーディング補助 | 複雑推論、企業 Agent 計画、強一貫性分類 |
| 消費シェアリーダー | Mimo V2.5、V4 Flash、Hy3 等 | Claude Sonnet 4.6 / Opus 4.7 各 13.5%;GPT-5.5 11.6% |
| 価格ロジック | 最大35倍の価格差、大量容错トラフィックを獲得 | Opus 5 は $5/$25 維持、FrontierBench v0.1 で 43.3% |
7月24日 Anthropic が Claude Opus 5 を発表:新ベンチ FrontierBench v0.1 で 43.3%(GPT-5.6 Sol 37.5%)、価格は Opus シリーズ $5/$25(Fable 5 入力価格の半分)——「高いが、その価値がある」。詳細は Claude Opus 5 発表と Kimi K3 論争をご覧ください。
選定のヒント:クローズド旗艦が最難 5%–10% のタスクを処理し、中国 OSS モデルが残り 90%+ の大量処理を担当——7月データが示す最も直接的な示唆であり、「誰が最強か」の白黒ではありません。
モデル榜は「どの頭脳が人気か」を反映し、アプリ層ランキングは「その頭脳が実際に何に使われているか」を反映します:
| 順位 | アプリ | タイプ | シェア(概) |
|---|---|---|---|
| 1 | Hermes Agent | 個人 Agent / CLI Agent | ~45% |
| 2 | Kilo Code | コーディング Agent | ~13% |
| 3 | OpenClaw | 汎用 Agent | ~9% |
| 4 | Claude Code | コーディング Agent | ~6% |
| 5 | Descript | コンテンツ制作 | ~4.5% |
| 7–9 | Lemonade / ISEKAI ZERO / Janitor AI | コンパニオン / ロールプレイ(新規上榜) | 各約 2% |
| 10 | Cline | コーディング Agent(IDE プラグイン) | ~1.7% |
Cline → Roo Code → Kilo Code は同一コード系譜の3回のフォーク、「孫世代」の Kilo Code が祖先 Cline を逆転しました。OpenRouter × a16z《State of AI》によると、創意ロールプレイシーンが OSS モデル総使用量の半分以上を占めます——企業 AI 報道だけ読んでいると、この半分は完全に見えません。
7月の推移と業界動向を踏まえ、8月について以下の判断を示し、主流モデルの価格定位対照を添えます(OpenRouter 接続チュートリアルと連携可能):
| モデル | 入力/M | 出力/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | コスパ王、Agentic Coding 第一候補 |
| MiniMax M3 | $0.10 | $1.21 | 長コンテキスト / マルチモーダル予算向け |
| GLM 5.2 | $0.45 | $3.31 | OSS 内 Opus 級計画品質に近い |
| Kimi K3 | ~$3 | ~$15 | 1.4TB OSS ウェイト、クローズド級能力 |
| Claude Opus 5 | $5(高速 $10) | $25(高速 $50) | クローズド旗艦、7月最強ベンチ |
個人開発者:OpenRouter を技術検証サンドボックスとして使うのは問題ありません。コーディングタスクは DeepSeek V4 Flash と GLM 5.2 を優先テストし、Opus 5 / GPT-5.6 は詰まった複雑ステップ用に残します。国内からのアクセス遅延は約 180–250ms、本番環境では国内コンプライアント中継を検討してください。
企業技術責任者:使用量榜だけで意思決定しないでください。タスクタイプ別に階層ルーティングし、「モデルサプライヤーの安全記録」を選定スコアカードに組み込みます。
毎週 openrouter.ai/rankings を固定確認:Top 12 とベンダーシェア変動を記録し、データ截止日を明記(榜单は日次変動)。
シーン別にゲートウェイルールを記述:雑談/創作 → V4 Flash / Mimo V2.5;複雑推論 → Claude Opus 5;高リスク分類 → Sonnet 4.6 / Opus 4.7。
Token 請求とドル請求を分離:Token の大半が Flash でドルの大半が Claude なら、既に階層化——ルーティング表を明示的に固定。
モデル層だけでなくアプリ層を追跡:コーディング Agent(Kilo Code、Claude Code)とロールプレイの流量構造は大きく異なり、プロダクトシーンに応じてモデルを選定。
8月新モデル向け回帰セットを確保:新 Top1 登場後 48 時間以内に同一評価セットを実行し、アプリを書き直すのではなくルーティングを更新。
Agent 実行層を固定:長セッション CLI Agent、機密 prefill を SSH 専有ノードへ移行;OpenRouter は弾力ピークのみ担当。仕様はレンタル価格をご覧ください。
ノート PC のスリープや廉価 Linux VPS では 12 時間超の Agent ループを支えにくく、xcodebuild、notarytool 等の macOS ツールチェーンも実行できません。「週榜を見る」と「実行環境を固定する」をセットにする方が、毎週単一「最強モデル」を追うより持続可能です。
安定 SSH 長セッション、Keychain 分離、予測可能な帯域が必要な iOS CI/CD と AI Agent 自動化チームには、ゲートウェイに OpenRouter マルチモデルルーティングを明記し、重負荷を専有クラウド Macに置く方が、すべての Token をパブリック API に賭けるより制御しやすいです。NodeMini Mac Mini クラウドレンタルを Agent 実行層として:API Key やモデルエンドポイントを変更しても SSH ノードと CI ラベルは維持できます。接続手順はヘルプセンターをご覧ください。
2026年7月25日時点、1日 Token 1位は小米 Mimo V2.5(約 1.4T/日)、次いで DeepSeek V4 Flash(943.9B/日)と腾讯 Hy3(590B/日)。榜单は日次変動するため、openrouter.ai/rankings のリアルタイムデータをご確認ください。
矛盾しません:統計口径(ベンダー7日シェア vs 全体 Token に無料/ロングテール含む)、統計ウィンドウ、第一方 App 流量の包含有無で数字は異なります。本文のベンダー表は複数ソース 7日口径の概数;重要なのは1年で 2% 未満から約 46% への急峻な移行トレンドです。月次シリーズは6月分析と対照してください。
① 中国 OSS 合計シェアが 50% を突破できるか。② Anthropic がより低価格モデルで使用量を奪うか。③ Kimi K3 コミュニティ量子化版の登場。④ 米国 AI 安全立法とホワイトハウス事前公開審査フレームワークが企業選定に与える影響。