真實 Token 用量 · 中國 46% 份額 · 用量≠品質 · Apps 隱藏市場 · 8 月預測
七月進入尾聲,若仍用幾個月前的印象判斷「哪個大模型最值得用」,大概率已經過時。結論:OpenRouter 排行榜不測跑分,只看開發者真金白銀把請求路由到誰家——截至 2026年7月25日,小米 Mimo V2.5 以約 1.4T Token/天 登頂,中國廠商合計份額約 46%,但用量冠軍≠品質冠軍,市場正分裂成「便宜跑量」與「閉源守難任務」的啞鈴結構。本文包含:Top 12 模型表、廠商份額、Apps 層 Hermes/Kilo Code/OpenClaw 洞察、8 月趨勢預測、分角色選型建議,以及 Mac 上分層路由五步驗收;可與 6 月排行榜、OpenRouter API 教學 互鏈。
截至 7 月 25 日,OpenRouter 單日 Token 用量前三名是 小米 Mimo V2.5(1.4 兆/天)、DeepSeek V4 Flash(9439 億/天)、騰訊 Hy3(5900 億/天)。前十名中中國廠商模型占七席,美國陣營主要由 NVIDIA Nemotron 3 Ultra、Claude 與 Gemini 系列守住位置。
| 排名 | 模型 | 廠商 | 單日 Token | 近 30 天累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 騰訊 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免費) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 螞蟻 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
拉長到廠商維度更震撼:中國廠商合計約 46% Token 份額,一年前不到 2%;美國 OpenAI + Anthropic + Google 合計從去年年中約 70% 滑落到目前 30%–36%。驅動因素主要是價格:DeepSeek V4 Flash 輸入約 $0.05–0.14/M,GPT-5.5 系列約 $5/M——價差可達 35 倍。
可引用:DeepSeek 仍是單一廠商份額最穩定的第一(約 16%–18%),但「月度冠軍模型」頻繁易主——2 月 MiniMax M2.5、4 月 MiMo-V2-Pro、7 月 Mimo V2.5。看榜不能只看單日快照,更要看誰能持續留在前排。
OpenRouter 排的是 Token 用量,不是能力。便宜又快的模型掛在高流量應用背後,就能刷到榜單前列——哪怕在複雜推理上表現平平。
把跑量當能力:角色扮演、閒聊、簡單補全占開源模型大量用量,與企業級「難任務」不是同一戰場。
忽略消費結構:按任務類型看消費金額,通用對話 35.7%、Agent 30.4%、程式碼 26.5%;但「分類/複雜推理」維度 Claude Sonnet 4.6 與 Opus 4.7 各約 13.5% 並列第一。
單日排名波動:7/24 Claude Opus 4.8 仍在前十,7/25 即被 Ling 3.0 Flash 擠出 Top 12——榜單日更,引用須標資料截止日。
安全變數上升:本週 OpenAI 未發布模型沙盒逃逸事件發酵,企業選型中「廠商安全聲譽」權重將明顯上升。
單一模型綁死:7/24 發布的 Claude Opus 5 在 FrontierBench v0.1 達 43.3%,仍維持 Opus 級 $5/$25 定價——難任務定價權仍在閉源旗艦手中。
| 市場分層 | 典型 workload | 用量榜常客 | 消費/難任務榜 |
|---|---|---|---|
| 高量、可容錯 | 閒聊、創意、角色扮演、簡單程式設計 | 中國開源 Flash 系 | 份額低 |
| 低容錯、高價值 | 複雜推理、企業 Agent 規劃、精準分類 | 榜單靠後 | Claude / GPT 旗艦 |
模型榜回答「哪個大腦受歡迎」;Apps 榜回答「這些大腦在幹什麼」:
| 排名 | 應用 | 類型 | 份額(約) |
|---|---|---|---|
| 1 | Hermes Agent | 個人 Agent / CLI | ~45% |
| 2 | Kilo Code | 程式設計 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 程式設計 Agent | ~6% |
| 5 | Descript | 內容生產 | ~4.5% |
| 6–10 | pi、Lemonade、ISEKAI ZERO、Janitor AI、Cline | Agent / 陪伴 / 角色扮演 | 各約 1.7%–3.3% |
Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,如今「孫子輩」Kilo Code 流量已反超祖輩 Cline——開源程式設計 Agent 迭代極快,先發優勢並不牢固。
OpenRouter × a16z《State of AI》顯示,創意角色扮演場景占開源模型總用量一半以上。若只讀企業 AI 報導,會完全錯過這塊市場——這也是本文相對「只貼表格」競品文的差異化角度。
中國開源合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商主動降價迎戰。
「月度冠軍」寶座繼續易主——小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰與迭代都不會放緩。
Anthropic 或推更平價型號搶占用量,Opus 5 已是兩個月內第四款旗艦,打法已從單點突破轉向多價位覆蓋。
Kimi K3 的 1.4TB 權重預計 2–4 週內出現社群量化版,中小團隊真正能用上還需等待推理雲就緒。
安全與合規成新選型變數——美國「AI 終止開關法案」與白宮預發布審查框架預計 8 月前落地。
| 模型 | 輸入/M | 輸出/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 性價比之王,Agentic Coding |
| MiniMax M3 | $0.10 | $1.21 | 長上下文多模態預算之選 |
| GLM 5.2 | $0.45 | $3.31 | 開源裡類 Opus 規劃品質 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB 開源權重,閉源級能力 |
| Claude Opus 5 | $5(快速檔 $10) | $25(快速檔 $50) | 閉源旗艦,難任務定價權 |
| 角色 | 推薦策略 |
|---|---|
| 獨立開發者 / 小團隊 | OpenRouter 做技術預研沙盒;程式設計優先測 DeepSeek V4 Flash 與 GLM 5.2,卡住的複雜步驟再切 Opus 5 / GPT-5.6 |
| 企業技術負責人 | 勿只看用量榜;按任務分層路由,並把供應商安全紀錄納入評分卡 |
| Agent / 程式設計工具產品 | 關注 Kilo Code 反超 Cline 的啟示;泛娛樂/陪伴場景用量遠超想像 |
在 Mac 上跑 Claude Code、OpenClaw 或 Kilo Code 時,建議按序落地分層路由:
任務分檔:S(最難 5%)→ 閉源旗艦;A(日常)→ DeepSeek / GLM;B(草稿)→ Flash 系。
統一入口:經 OpenRouter 或 OpenClaw models 配置,避免業務硬編碼單一 provider。
帳單告警:按模型設日/週 Token 上限,防止 Agent 循環誤用 Opus。
品質探針:固定 10–20 條回歸提示詞,新模型上線先跑探針再切流。
VNC 圖形驗收:OAuth、Gateway、瀏覽器 MCP 與權限彈窗在遠端 Mac 圖形會話中與 Agent 同機核對。
從 0 到 1 接入多模型。
閱讀 →中國模型 61% 與 Q3 預測。
閱讀 →7 月下旬兩大熱點。
閱讀 →不是。它按真實付費 Token 用量排序。難任務消費份額上 Claude Sonnet 4.6 與 Opus 4.7 仍並列領先。
截至 7 月 25 日,小米 Mimo V2.5 約 1.4T Token/天 居首,其次是 DeepSeek V4 Flash 與騰訊 Hy3。
綜合約 46%,一年前不到 2%;美國三巨頭合計約 30%–36%。
Nous Research 的開源自我迭代 Agent 在 Apps 榜約占 45%,反映個人 Agent / CLI 自動化的高頻調用特徵。
7 月榜單最值得記住的一句話:capability(能力)與 popularity(用量)正在分道揚鑣。中國開源模型靠價格拿下流量半壁江山,美國閉源旗艦仍守著難任務定價權與安全聲譽護城河。
若你主力機在 Windows/Linux,又要在 macOS 上跑 Claude Code、OpenClaw 或 Kilo Code 做多模型驗收,自建 Mac 有折舊與睡眠成本,純 SSH 又難處理 OAuth 與系統權限彈窗。租用 VNCMac 遠端 Mac + VNC 圖形會話可在與 Gateway 同機環境下對照 OpenRouter Dashboard 做分層路由驗收,把「跟榜」變成可複現工作流。
資料截止 2026 年 7 月 25 日,發布前請以 openrouter.ai/rankings 即時資料為準。