「よく聞くモデル名」だけで選ぶと何が起きるか

1年前のOpenRouterと7月の榜单を並べると、別世界と言っても過言ではありません。開発チームが直面している摩擦点は次のとおりです。

  • 日次変動が激しい:Mimo V2.5は7月24日から25日にかけてTop10内の順位すら入れ替わっており、単一スナップショットでは長期判断ができません。
  • トークン量≠品質:低単価モデルが高流量アプリの背後に載れば榜单上位に並びますが、複雑推論ではクローズド系フラッグシップが依然として消費額の主役です。
  • 見えない需要:ロールプレイ・伴走系アプリがオープンソースモデル用量の相当部分を占めますが、エンタープライズ向け報道ではほとんど触れられません。
  • 単価差の拡大:DeepSeek V4 Flashの入力は約$0.05–0.14/M、GPT-5.5は約$5/M — 約35倍の差がルーティング判断を左右しています。
  • セキュリティが新変数に:OpenAI未公開モデルのサンドボックス脱出報道が広がり、企業調達ではベンダーの安全実績が重み付けされ始めています。

2026年7月25日時点:モデルトークン用量Top 12

1日あたりのトークン用量Top10のうち7席を中国ベンダーモデルが占めます。DeepSeekは単一ベンダーとして16%–18%で最も安定したシェアを維持していますが、「月間チャンピオンモデル」の座は頻繁に入れ替わっています。

順位 モデル ベンダー 1日トークン 直近30日累計
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3Tencent590B23.4T
4Nemotron 3 Ultra 550B(無料)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智谱 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash阶跃星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新規)
10Ling 3.0 Flash蚂蚁 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

ベンダーシェアと単価:中国約46%、米国約30%–36%

ベンダー単位に集計すると、中国陣営の合計トークンシェアは約46%(1年前は2%未満)です。米国3大ベンダー合計は年中の約70%から30%–36%へと低下しました。これはナラティブではなく、純粋な価格ロジックの結果です。

ベンダー トークンシェア(概算) 代表モデルの位置づけ
DeepSeek16%–18%コスパ最強、Agentic Coding向け
小米8%–18%Mimo V2.5急伸、変動最大
Anthropic10%–15%クローズド系フラッグシップ、難タスクで価格決定力
Tencent8%–13%Hy3が大量処理を担う
Google8%–13%Gemini Flashシリーズ
智谱 Z.ai4%–7%GLM 5.2がOpus級の計画品質に近い
OpenAI6%–8%GPT-5.5は高単価帯

単価対照表が流量移動の背景を説明します。

モデル 入力/M 出力/M 位置づけ
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28コスパ最強
MiniMax M3$0.10$1.21長コンテキストの予算向け
GLM 5.2$0.45$3.31オープン系Opus級計画
Kimi K3~$3~$151.4TBオープンウェイト最大級
Claude Opus 5$5(高速$10)$25(高速$50)クローズド系フラッグシップ、7月ベンチ最強

用量リーダーと品質は別次元 — ダンベル型市場

OpenRouterがタスク種別ごとに集計する消費金額シェア(トークン量ではない)を見ると、全く異なる絵が浮かび上がります。一般対話35.7%、Agentワークフロー30.4%、コード26.5%、データ処理7.5% — しかし「分類・複雑推論」に絞ると、Claude Sonnet 4.6とClaude Opus 4.7が各13.5%で並び1位、GPT-5.5が11.6%で3位です。总量榜单の低単価オープンソースモデルはこの軸ではほぼ姿を見せません。

市場は自然に二層化しています。中国系の低単価オープンソースモデルが、雑談・創作・ロールプレイ・簡易コーディング支援など大量かつ許容度の高いタスクを吸収し、クローズド系フラッグシップは高付加価値・低許容度の難タスクで価格決定力を維持しています。7月24日にAnthropicが発表したClaude Opus 5はFrontierBench v0.1で43.3%(GPT-5.6 Solの37.5%を上回る)を記録し、Opusシリーズ通例の$5/$25 per million tokensを維持 — 「高いが、その価値がある」という立ち位置の典型です。

アプリ層の実態:コーディングAgentと隠れたRP需要

モデル層ランキングは「どの頭脳が選ばれているか」を示し、アプリ層ランキング(openrouter.ai/apps)は「その頭脳が実際に何に使われているか」を示します。

  • Hermes Agent(Nous Research)が約45%のトークンシェアで単独首位 — プラットフォーム最大の単一アプリです。
  • コーディング系Agentが榜单の大半を占めます:Kilo Code(~13%)、OpenClaw(~9%)、Claude Code(~6%)、Cline(~1.7%)がすべてTop10入りです。
  • Cline → Roo Code → Kilo Codeは同一コード系譜の3分岐であり、「孫世代」のKilo Codeが祖先を用量で逆転 — オープンソースコーディングAgentの堀は想定より浅いことを示しています。
  • ロールプレイ・伴走系(Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI)の合計用量も無視できません。OpenRouter × a16z「State of AI」報告書によると、創作ロールプレイシーンがオープンソースモデル総用量の半分以上を占めます。
順位 アプリ 種別 シェア(概算)
1Hermes Agent個人Agent/CLI Agent~45%
2Kilo CodeコーディングAgent~13%
3OpenClaw汎用Agent~9%
4Claude CodeコーディングAgent~6%
5Descriptコンテンツ制作~4.5%
6piAgent~3.3%
7Lemonade伴走/ゲーム~2.1%
8ISEKAI ZEROロールプレイ~2.0%
9Janitor AIロールプレイ~1.8%
10ClineコーディングAgent(IDE拡張)~1.7%

8月に注目すべき5つのシグナル

  1. 中国オープンソースモデル合計シェアは50%突破の可能性 — 米国ベンダーが大幅な値下げをしない限り、上昇トレンドは続く見込みです。
  2. 「月間チャンピオンモデル」は引き続き入れ替わる — 小米・DeepSeek・Tencent・智谱・MiniMax・月之暗面の価格競争は緩まないでしょう。
  3. Anthropicは8月にHaiku級の低単価モデルを投入する可能性 — Opus 5は2か月で4つ目のフラッグシップです。
  4. Kimi K3の1.4TB重みは2–4週間以内にコミュニティ量子化版が登場し、中小チームが実際に使える段階に入る見込みです。
  5. 安全・コンプライアンスが選定変数に — OpenAIサンドボックス脱出報道、米議会の「AI停止スイッチ法案」、ホワイトハウスのフロンティアモデル事前審査枠組みが、企業調達でのベンダー安全記録の重みを押し上げます。

6ステップで構築する階層型ルーティング

用量ランキングだけで決めてはいけません。以下の6ステップでOpenRouterデータを実行可能なエンジニアリング戦略に変換します(未接続の場合は先にOpenRouter APIガイドを参照してください)。

  1. データ基準日を記録し月次レビューを固定する:openrouter.ai/rankingsを開き、閲覧日を記録します。榜单は日次で変動するため、月末に固定照合しシリーズ資産として蓄積することをおすすめします。
  2. タスク種別ごとに評価セットを分割する:雑談/創作、Agentワークフロー、コード、複雑推論の4類に分け、採用率・エラー率・P95レイテンシを個別に記録 — 総合スコア1つで全シーンを代表させないでください。
  3. 大量処理層は低単価オープンソースへ:雑談・創作・ロールプレイ・簡易コーディング支援ではDeepSeek V4 Flash(コスパ最優)とGLM 5.2(オープン系でOpus級計画品質に最も近い)を優先テストします。
  4. 難タスク層はクローズド系フラッグシップへ:分類・複雑推論・高リスクAgent判断はClaude Opus 5 / GPT-5.6へルーティングし、低単価モデルが実際に詰まったステップだけで起動するハイブリッド構成で大幅なコスト削減が可能です。
  5. コーディングAgentシーンでA/B分岐テストを行う:同一コードベース上でKilo Code、Cline、OpenClawのデフォルトバックエンドとFallbackチェーンを比較し、トークンコストと修正成功率を記録 — オープンソースAgentエコシステムの迭代速度は速く、先行者優位は必ずしも持続しません。
  6. ベンダー安全記録をスコアカードに組み込む:各候補モデル/ベンダーについてサンドボックス事件、データ保持ポリシー、権限収束能力を記録します。自律Agentシーンでは最小権限と人手承認ゲートを必須とします。

OpenRouterでの技術検証は十分可能ですが、本番運用では平均レイテンシ約180–250ms、国内向けインボイス非対応などの制約があります。コンプライアンス要件が厳しい場合は国内中継APIの評価も検討してください。

引用可能な数値と公式ソース

  • 中国ベンダー合計約46%トークンシェア:1年前は2%未満 — 過去12か月で最も急峻なシェア移動の一つ。OpenRouter公式ランキングとtokenmaxxing、digitalapplied、fourweekmba等の第三者7日間集計を総合。
  • DeepSeek V4 Flash vs GPT-5.5の単価差約35倍:入力単価がそれぞれ約$0.05–0.14/Mと~$5/M — 中国オープンソースモデルへの流量移動の主因です。
  • Hermes Agent約45%のアプリ層シェア:2位Kilo Code(~13%)を大きく引き離し、個人/CLI AgentがOpenRouterエコシステム最大の単一流量入口であることを示します。
  • Claude Opus 5のFrontierBench v0.1スコア43.3%:GPT-5.6 Solの37.5%を上回り、単価$5/$25 per million tokensを維持 — Anthropic公式発表がソースです。

ランキング数値は日次で変動します。公開前は必ず公式のリアルタイムデータを確認してください。

以下はOpenRouter公式モデルランキング(一次データソース)です。

OpenRouter Model Rankings

以下はOpenRouter公式アプリ層ランキングです。

OpenRouter Apps Leaderboard

以下はOpenRouter × a16z「State of AI」報告書です。

OpenRouter State of AI 2025

以下はAnthropic Claude Opus 5公式発表です。

Introducing Claude Opus 5 — Anthropic

OpenRouterランキング FAQ

OpenRouterランキングは何を基準に並べ替えていますか?

実際に課金されたトークン用量で並びます。ベンチマークスコアではありません。低単価モデルが高流量アプリの背後に載れば前列に並ぶこともあります。

2026年7月の用量1位はどのモデルですか?

7月25日時点の1日トークン1位は小米 Mimo V2.5(約1.4兆/日)です。続いてDeepSeek V4 Flash(約9439億/日)、Tencent Hy3(約5900億/日)です。

中国製大規模言語モデルのシェアは?

複数ソースの7日間集計では、中国ベンダー合計で約46%、米国ベンダー合計で約30%–36%のトークンシェアです。

個人開発者はどう選べばよいですか?

OpenRouterを技術検証のサンドボックスとして使い、コーディングタスクはDeepSeek V4 Flash + GLM 5.2を優先し、本当に詰まった複雑ステップだけClaude Opus 5に回すハイブリッドルーティングでコストを抑えられます。

Kilo Code、Cline、Hermes Agentで複数モデルを比較する際、主力開発マシン上でバックエンドを入れ替え続けるとグローバル設定が汚染されます。KVMFLUXの日額から借りられるクラウドMac miniはRoot権限、SSH + VNCデュアルアクセス、物理M4ハードウェア独占を提供 — クリーンな環境でDeepSeek V4 FlashとClaude Opus 5のFallbackチェーンを並行検証し、終わったら即退租、SDKやAgent残留を残しません。レンタル期間の選び方を検討中であれば、月次ランキング駆動の短期検証には日額プランが最適です。

実機Apple SiliconでコーディングAgentルートを検証

日額でMac mini M4を起動し、Kilo Code / Clineの多モデル比較とFallback検証を実行。榜单更新後すぐ再テストして退租できます。

Mac Mini M4 · 16GB / 256GB
日額$19.3 /日
週額$52.2 /週
月額$96.7 /月
四半期$263 /四半期