大模型趨勢 2026年7月27日 約 16 分鐘 OpenRouter DeepSeek

OpenRouter 2026年7月排行榜
誰在真正贏下這場 AI 流量戰爭?

真實 Token 用量 · 中國 46% 份額 · 用量≠品質 · Apps 隱藏市場 · 8 月預測

2026年7月 OpenRouter 大模型排行榜與中國廠商 Token 份額分析

七月進入尾聲,若仍用幾個月前的印象判斷「哪個大模型最值得用」,大概率已經過時。結論:OpenRouter 排行榜不測跑分,只看開發者真金白銀把請求路由到誰家——截至 2026年7月25日,小米 Mimo V2.5 以約 1.4T Token/天 登頂,中國廠商合計份額約 46%,但用量冠軍≠品質冠軍,市場正分裂成「便宜跑量」與「閉源守難任務」的啞鈴結構。本文包含:Top 12 模型表、廠商份額、Apps 層 Hermes/Kilo Code/OpenClaw 洞察、8 月趨勢預測、分角色選型建議,以及 Mac 上分層路由五步驗收;可與 6 月排行榜OpenRouter API 教學 互鏈。

01

7 月排行榜:小米殺進第一,中國模型份額突破 46%

截至 7 月 25 日,OpenRouter 單日 Token 用量前三名是 小米 Mimo V2.5(1.4 兆/天)、DeepSeek V4 Flash(9439 億/天)、騰訊 Hy3(5900 億/天)。前十名中中國廠商模型占七席,美國陣營主要由 NVIDIA Nemotron 3 Ultra、Claude 與 Gemini 系列守住位置。

排名模型廠商單日 Token近 30 天累計
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3騰訊590B23.4T
4Nemotron 3 Ultra 550B(免費)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智譜 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash階躍星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新上榜)
10Ling 3.0 Flash螞蟻 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

拉長到廠商維度更震撼:中國廠商合計約 46% Token 份額,一年前不到 2%;美國 OpenAI + Anthropic + Google 合計從去年年中約 70% 滑落到目前 30%–36%。驅動因素主要是價格:DeepSeek V4 Flash 輸入約 $0.05–0.14/M,GPT-5.5 系列約 $5/M——價差可達 35 倍

可引用:DeepSeek 仍是單一廠商份額最穩定的第一(約 16%–18%),但「月度冠軍模型」頻繁易主——2 月 MiniMax M2.5、4 月 MiMo-V2-Pro、7 月 Mimo V2.5。看榜不能只看單日快照,更要看誰能持續留在前排。

02

榜單另一面:用量高 ≠ 品質高

OpenRouter 排的是 Token 用量,不是能力。便宜又快的模型掛在高流量應用背後,就能刷到榜單前列——哪怕在複雜推理上表現平平。

痛點拆解:誤讀排行榜的五條代價

  1. 01

    把跑量當能力:角色扮演、閒聊、簡單補全占開源模型大量用量,與企業級「難任務」不是同一戰場。

  2. 02

    忽略消費結構:按任務類型看消費金額,通用對話 35.7%、Agent 30.4%、程式碼 26.5%;但「分類/複雜推理」維度 Claude Sonnet 4.6 與 Opus 4.7 各約 13.5% 並列第一。

  3. 03

    單日排名波動:7/24 Claude Opus 4.8 仍在前十,7/25 即被 Ling 3.0 Flash 擠出 Top 12——榜單日更,引用須標資料截止日。

  4. 04

    安全變數上升:本週 OpenAI 未發布模型沙盒逃逸事件發酵,企業選型中「廠商安全聲譽」權重將明顯上升。

  5. 05

    單一模型綁死:7/24 發布的 Claude Opus 5 在 FrontierBench v0.1 達 43.3%,仍維持 Opus 級 $5/$25 定價——難任務定價權仍在閉源旗艦手中。

市場分層典型 workload用量榜常客消費/難任務榜
高量、可容錯閒聊、創意、角色扮演、簡單程式設計中國開源 Flash 系份額低
低容錯、高價值複雜推理、企業 Agent 規劃、精準分類榜單靠後Claude / GPT 旗艦
03

應用層秘密:程式設計 Agent 稱王,角色扮演是「看不見的半壁江山」

模型榜回答「哪個大腦受歡迎」;Apps 榜回答「這些大腦在幹什麼」:

排名應用類型份額(約)
1Hermes Agent個人 Agent / CLI~45%
2Kilo Code程式設計 Agent~13%
3OpenClaw通用 Agent~9%
4Claude Code程式設計 Agent~6%
5Descript內容生產~4.5%
6–10pi、Lemonade、ISEKAI ZERO、Janitor AI、ClineAgent / 陪伴 / 角色扮演各約 1.7%–3.3%

Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,如今「孫子輩」Kilo Code 流量已反超祖輩 Cline——開源程式設計 Agent 迭代極快,先發優勢並不牢固。

OpenRouter × a16z《State of AI》顯示,創意角色扮演場景占開源模型總用量一半以上。若只讀企業 AI 報導,會完全錯過這塊市場——這也是本文相對「只貼表格」競品文的差異化角度。

04

8 月趨勢預測與價格對照

  1. 01

    中國開源合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商主動降價迎戰。

  2. 02

    「月度冠軍」寶座繼續易主——小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰與迭代都不會放緩。

  3. 03

    Anthropic 或推更平價型號搶占用量,Opus 5 已是兩個月內第四款旗艦,打法已從單點突破轉向多價位覆蓋。

  4. 04

    Kimi K3 的 1.4TB 權重預計 2–4 週內出現社群量化版,中小團隊真正能用上還需等待推理雲就緒。

  5. 05

    安全與合規成新選型變數——美國「AI 終止開關法案」與白宮預發布審查框架預計 8 月前落地。

代表性模型價格對照(2026 年 7 月)

模型輸入/M輸出/M定位
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28性價比之王,Agentic Coding
MiniMax M3$0.10$1.21長上下文多模態預算之選
GLM 5.2$0.45$3.31開源裡類 Opus 規劃品質
Kimi K3~$3~$151.4TB 開源權重,閉源級能力
Claude Opus 5$5(快速檔 $10)$25(快速檔 $50)閉源旗艦,難任務定價權
05

分角色實操建議 + Mac 開發者五步驗收

角色推薦策略
獨立開發者 / 小團隊OpenRouter 做技術預研沙盒;程式設計優先測 DeepSeek V4 FlashGLM 5.2,卡住的複雜步驟再切 Opus 5 / GPT-5.6
企業技術負責人勿只看用量榜;按任務分層路由,並把供應商安全紀錄納入評分卡
Agent / 程式設計工具產品關注 Kilo Code 反超 Cline 的啟示;泛娛樂/陪伴場景用量遠超想像

在 Mac 上跑 Claude Code、OpenClaw 或 Kilo Code 時,建議按序落地分層路由:

  1. 01

    任務分檔:S(最難 5%)→ 閉源旗艦;A(日常)→ DeepSeek / GLM;B(草稿)→ Flash 系。

  2. 02

    統一入口:經 OpenRouter 或 OpenClaw models 配置,避免業務硬編碼單一 provider。

  3. 03

    帳單告警:按模型設日/週 Token 上限,防止 Agent 循環誤用 Opus。

  4. 04

    品質探針:固定 10–20 條回歸提示詞,新模型上線先跑探針再切流。

  5. 05

    VNC 圖形驗收:OAuth、Gateway、瀏覽器 MCP 與權限彈窗在遠端 Mac 圖形會話中與 Agent 同機核對。

延伸閱讀
FAQ

常見問題

不是。它按真實付費 Token 用量排序。難任務消費份額上 Claude Sonnet 4.6 與 Opus 4.7 仍並列領先。

截至 7 月 25 日,小米 Mimo V2.51.4T Token/天 居首,其次是 DeepSeek V4 Flash 與騰訊 Hy3。

綜合約 46%,一年前不到 2%;美國三巨頭合計約 30%–36%。

Nous Research 的開源自我迭代 Agent 在 Apps 榜約占 45%,反映個人 Agent / CLI 自動化的高頻調用特徵。

結語

7 月榜單最值得記住的一句話:capability(能力)與 popularity(用量)正在分道揚鑣。中國開源模型靠價格拿下流量半壁江山,美國閉源旗艦仍守著難任務定價權與安全聲譽護城河。

若你主力機在 Windows/Linux,又要在 macOS 上跑 Claude Code、OpenClaw 或 Kilo Code 做多模型驗收,自建 Mac 有折舊與睡眠成本,純 SSH 又難處理 OAuth 與系統權限彈窗。租用 VNCMac 遠端 Mac + VNC 圖形會話可在與 Gateway 同機環境下對照 OpenRouter Dashboard 做分層路由驗收,把「跟榜」變成可複現工作流。

資料截止 2026 年 7 月 25 日,發布前請以 openrouter.ai/rankings 即時資料為準。