実トークン量 · 中国系46% · 用量≠品質 · Apps層 · 8月展望
2ヶ月前のベンチマーク表だけで LLM を選んでいるなら、すでに遅れています。結論:OpenRouter は各社をスコアリングせず、有料の実トラフィックをルーティングします。2026年7月25日時点で 小米 Mimo V2.5 が約 1.4T トークン/日で首位、中国系ラボの合計は約 46%。ただし用量順位は品質指標ではない——市場は「安いオープンウェイトの大量処理」と「閉源フロンティアの難タスク課金」というダンベル構造に分裂しています。本記事:Top 12 モデル表、プロバイダシェア、Apps 榜(Hermes / Kilo Code / OpenClaw)、8月展望、役割別ルーティング、Mac 向け5ステップ受け入れチェックリスト。6月ランキング・OpenRouter API ガイドも参照。
7月25日時点の日次トークン量トップ3は Mimo V2.5(1.4T/日)、DeepSeek V4 Flash(943.9B/日)、Tencent Hy3(590B/日)。トップ10のうち7モデルが中国系。米国側は NVIDIA Nemotron 3 Ultra、Claude、Gemini が要所を守っています。
| 順位 | モデル | ラボ | 日次トークン | 30日累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | Tencent | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(無料) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | StepFun | 204.8B | 5.9T |
| 9 | Kimi K3 | Moonshot | 157.6B | 1.6T(新規) |
| 10 | Ling 3.0 Flash | InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
プロバイダ単位では、中国系ラボが特定トークン量の約46%を占め、1年前の2%未満から急伸。米国各社(OpenAI・Anthropic・Google)は2025年半ばの約70%から 30〜36%へ。価格構造の話です:DeepSeek V4 Flash の入力は $0.05〜$0.14/M、GPT-5.5 は約 $5/M——おおよそ 35倍の差。
引用用:DeepSeek は最も安定した #1 プロバイダ(約16〜18%)ですが、「今月の王座」は MiniMax M2.5(2月)→ MiMo-V2-Pro(4月)→ Mimo V2.5(7月)とローテーションしています。
安く速いモデルが1つの高トラフィック消費者アプリに組み込まれれば、最難関10%用に温存された高能力モデルより上位に見えます。
ボリュームと能力の混同:ロールプレイ・チャット・軽コーディングがオープンモデル流量の大半——エンタープライズ級推論ではない。
支出ミックスの無視:カテゴリ別ではチャット35.7%、Agentic 30.4%、コード26.5%——分類では Claude Sonnet 4.6 と Opus 4.7 が各13.5%で並ぶ。
日次の揺れ:7/24 時点で Claude Opus 4.8 はトップ10入り;7/25 には Ling 3.0 Flash が押し出しトップ12圏外へ。必ずカットオフ日を明記。
セキュリティ比重の上昇:今週の OpenAI サンドボックス脱出開示は、エンタープライズ選定に「ベンダ安全実績」を加える。
単一モデル固定:Claude Opus 5(7/24)は FrontierBench v0.1 で43.3%首位、Opus級 $5/$25 価格を維持——フロンティア各社は難タスクで課金力を守る。
| セグメント | 典型ワークロード | 流量チャート | 難タスク支出 |
|---|---|---|---|
| 高流量・許容度高 | チャット、創作、ロールプレイ、定常コーディング | 中国系オープン Flash | 低シェア |
| 低許容・高価値 | 複雑推論、Agent 計画、分類 | トップ10に稀 | Claude / GPT フロンティア |
モデル榜は「どの脳が人気か」を示す。Apps リーダーボードは「その脳で何をしているか」を示す:
| 順位 | アプリ | 種別 | シェア(概算) |
|---|---|---|---|
| 1 | Hermes Agent | 個人 / CLI Agent | ~45% |
| 2 | Kilo Code | コーディング Agent | ~13% |
| 3 | OpenClaw | 汎用 Agent | ~9% |
| 4 | Claude Code | コーディング Agent | ~6% |
| 5 | Descript | コンテンツ | ~4.5% |
| 6–10 | pi, Lemonade, ISEKAI ZERO, Janitor AI, Cline | Agent / コンパニオン / ロールプレイ | 各 ~1.7%〜3.3% |
Cline → Roo Code → Kilo Code は同一系譜の3フォーク。最も新しい Kilo Code が両祖先を上回った——オープンソース開発ツールの先行者利益は長くは続かない。
OpenRouter × a16z の State of AI レポートでは、創作ロールプレイがオープンモデル使用の半数超。エンタープライズ見出しだけ見ていると、市場の半分を見逃している。
中国系オープンウェイトのシェアは50%前後へ——米大手が大幅値下げしない限り。
月次 #1 はローテーション継続——小米、DeepSeek、Tencent、Z.ai、MiniMax、Moonshot 間で。
Anthropic が安価なボリューム tier を出す可能性——Opus 5 は2ヶ月未満で4代目のフラッグシップ。
Kimi K3 の1.4TB ウェイトは2〜4週間でコミュニティ量子化が進む見込み。
セキュリティ・ガバナンスが選定基準に——米「AI Kill Switch」法案とホワイトハウス事前審査枠組みが8月前に予想。
| モデル | 入力/M | 出力/M | ポジショニング |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | コスパ最強;Agentic コーディング |
| MiniMax M3 | $0.10 | $1.21 | 低予算の長コンテキスト |
| GLM 5.2 | $0.45 | $3.31 | オープンウェイト Opus 型計画 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB オープンウェイト |
| Claude Opus 5 | $5(fast $10) | $25(fast $50) | 閉源フロンティア;難タスク |
| 役割 | 推奨アプローチ |
|---|---|
| 個人 / 小規模チーム | OpenRouter をサンドボックスに;DeepSeek V4 Flash と GLM 5.2 でコーディング開始、失敗するステップだけ Opus 5 / GPT-5.6 |
| インフラリード | 用量順位だけで選ばない;タスクリスクで tier 分け、ベンダ安全をスコアカードに追加 |
| Agent / 開発ツールビルダー | Kilo Code フォーク史を研究;コンパニオン・娯楽流量はエンタープライズ報道に出なくても実在 |
Mac で Claude Code、OpenClaw、Kilo Code を使うなら、ダンベルルーティングを次の順で実装:
タスク tier 化:S級(最難5%)→ 閉源フロンティア;A級 → DeepSeek / GLM;B級 → Flash クラス。
単一ルーター:OpenRouter または OpenClaw の models 設定——アプリコードにプロバイダをハードコードしない。
支出アラート:モデル別の日次/週次上限で Agent の Opus ループを防止。
品質プローブ:新モデルへ流量を移す前に10〜20件の固定回帰プロンプト。
VNC 受け入れ:OAuth、Gateway、ブラウザ MCP、権限ダイアログを Agent と同居するグラフィカル Mac セッションで検証。
1キーで400+モデル。
読む →中国系61%とQ3展望。
読む →7月下旬の二大ヘッドライン。
読む →いいえ——有料トークン量でソート。難タスク支出では Claude Sonnet 4.6 と Opus 4.7 が並んでいます。
7月25日時点、小米 Mimo V2.5 が約 1.4T トークン/日。続いて DeepSeek V4 Flash、Tencent Hy3。
合計約 46%(1年前は2%未満)。米国各社は約 30〜36%。
Nous Research のオープン自己改善 Agent がアプリトークンの約 45%——高頻度の個人自動化であり、品質投票ではない。
7月に覚えておくべき一行:能力と人気は乖離している。中国系オープンウェイトは価格で市場の半分を獲得;米国閉源フロンティアは難タスクと安全信頼で另一半を守る。
日常ドライバーが Windows や Linux でも、Claude Code、OpenClaw、Kilo Code に macOS が必要なら、Mac 購入は減価償却とスリープ設定のオーバーヘッド。SSH のみでは OAuth と権限ダイアログを通過できない。VNCMac リモート Mac(VNC)なら、Gateway と同じマシン上で OpenRouter ダッシュボードに照らしながらダンベルルーティングを検証できる。日本語プラン・ホームからご確認ください。
データは2026年7月25日時点——引用前に openrouter.ai/rankings で最新値を確認してください。