真实 Token 用量 · 中国 46% 份额 · 用量≠质量 · Apps 隐藏市场 · 8 月预测
七月进入尾声,若仍用几个月前的印象判断「哪个大模型最值得用」,大概率已经过时。结论:OpenRouter 排行榜不测跑分,只看开发者真金白银把请求路由到谁家——截至 2026年7月25日,小米 Mimo V2.5 以约 1.4T Token/天 登顶,中国厂商合计份额约 46%,但用量冠军≠质量冠军,市场正分裂成「便宜跑量」与「闭源守难任务」的哑铃结构。本文包含:Top 12 模型表、厂商份额、Apps 层 Hermes/Kilo Code/OpenClaw 洞察、8 月趋势预测、分角色选型建议,以及 Mac 上分层路由五步验收;可与 6 月排行榜、OpenRouter API 教程 互链。
截至 7 月 25 日,OpenRouter 单日 Token 用量前三名是 小米 Mimo V2.5(1.4 万亿/天)、DeepSeek V4 Flash(9439 亿/天)、腾讯 Hy3(5900 亿/天)。前十名中中国厂商模型占七席,美国阵营主要由 NVIDIA Nemotron 3 Ultra、Claude 与 Gemini 系列守住位置。
| 排名 | 模型 | 厂商 | 单日 Token | 近 30 天累计 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免费) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
拉长到厂商维度更震撼:中国厂商合计约 46% Token 份额,一年前不到 2%;美国 OpenAI + Anthropic + Google 合计从去年年中约 70% 滑落到目前 30%–36%。驱动因素主要是价格:DeepSeek V4 Flash 输入约 $0.05–0.14/M,GPT-5.5 系列约 $5/M——价差可达 35 倍。
可引用:DeepSeek 仍是单一厂商份额最稳定的第一(约 16%–18%),但「月度冠军模型」频繁易主——2 月 MiniMax M2.5、4 月 MiMo-V2-Pro、7 月 Mimo V2.5。看榜不能只看单日快照,更要看谁能持续留在前排。
OpenRouter 排的是 Token 用量,不是能力。便宜又快的模型挂在高流量应用背后,就能刷到榜单前列——哪怕在复杂推理上表现平平。
把跑量当能力:角色扮演、闲聊、简单补全占开源模型大量用量,与企业级「难任务」不是同一战场。
忽略消费结构:按任务类型看消费金额,通用对话 35.7%、Agent 30.4%、代码 26.5%;但「分类/复杂推理」维度 Claude Sonnet 4.6 与 Opus 4.7 各约 13.5% 并列第一。
单日排名波动:7/24 Claude Opus 4.8 仍在前十,7/25 即被 Ling 3.0 Flash 挤出 Top 12——榜单日更,引用须标数据截止日。
安全变量上升:本周 OpenAI 未发布模型沙盒逃逸事件发酵,企业选型中「厂商安全声誉」权重将明显上升。
单一模型绑死:7/24 发布的 Claude Opus 5 在 FrontierBench v0.1 达 43.3%,仍维持 Opus 级 $5/$25 定价——难任务定价权仍在闭源旗舰手中。
| 市场分层 | 典型 workload | 用量榜常客 | 消费/难任务榜 |
|---|---|---|---|
| 高量、可容错 | 闲聊、创意、角色扮演、简单编程 | 中国开源 Flash 系 | 份额低 |
| 低容错、高价值 | 复杂推理、企业 Agent 规划、精准分类 | 榜单靠后 | Claude / GPT 旗舰 |
模型榜回答「哪个大脑受欢迎」;Apps 榜回答「这些大脑在干什么」:
| 排名 | 应用 | 类型 | 份额(约) |
|---|---|---|---|
| 1 | Hermes Agent | 个人智能体 / CLI | ~45% |
| 2 | Kilo Code | 编程 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 编程 Agent | ~6% |
| 5 | Descript | 内容生产 | ~4.5% |
| 6–10 | pi、Lemonade、ISEKAI ZERO、Janitor AI、Cline | Agent / 陪伴 / 角色扮演 | 各约 1.7%–3.3% |
Cline → Roo Code → Kilo Code 是同一代码血统的三次分叉,如今「孙子辈」Kilo Code 流量已反超祖辈 Cline——开源编程 Agent 迭代极快,先发优势并不牢固。
OpenRouter × a16z《State of AI》显示,创意角色扮演场景占开源模型总用量一半以上。若只读企业 AI 报道,会完全错过这块市场——这也是本文相对「只贴表格」竞品文的差异化角度。
中国开源合计份额大概率继续爬升,年内有望突破 50%,除非美国厂商主动降价迎战。
「月度冠军」宝座继续易主——小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面价格战与迭代都不会放缓。
Anthropic 或推更平价型号抢占用量,Opus 5 已是两个月内第四款旗舰,打法已从单点突破转向多价位覆盖。
Kimi K3 的 1.4TB 权重预计 2–4 周内出现社区量化版,中小团队真正能用上还需等待推理云就绪。
安全与合规成新选型变量——美国「AI 终止开关法案」与白宫预发布审查框架预计 8 月前落地。
| 模型 | 输入/M | 输出/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 性价比之王,Agentic Coding |
| MiniMax M3 | $0.10 | $1.21 | 长上下文多模态预算之选 |
| GLM 5.2 | $0.45 | $3.31 | 开源里类 Opus 规划质量 |
| Kimi K3 | ~$3 | ~$15 | 1.4TB 开源权重,闭源级能力 |
| Claude Opus 5 | $5(快速档 $10) | $25(快速档 $50) | 闭源旗舰,难任务定价权 |
| 角色 | 推荐策略 |
|---|---|
| 独立开发者 / 小团队 | OpenRouter 做技术预研沙盒;编程优先测 DeepSeek V4 Flash 与 GLM 5.2,卡住的复杂步骤再切 Opus 5 / GPT-5.6 |
| 企业技术负责人 | 勿只看用量榜;按任务分层路由,并把供应商安全记录纳入评分卡 |
| Agent / 编程工具产品 | 关注 Kilo Code 反超 Cline 的启示;泛娱乐/陪伴场景用量远超想象 |
在 Mac 上跑 Claude Code、OpenClaw 或 Kilo Code 时,建议按序落地分层路由:
任务分档:S(最难 5%)→ 闭源旗舰;A(日常)→ DeepSeek / GLM;B(草稿)→ Flash 系。
统一入口:经 OpenRouter 或 OpenClaw models 配置,避免业务硬编码单一 provider。
账单告警:按模型设日/周 Token 上限,防止 Agent 循环误用 Opus。
质量探针:固定 10–20 条回归提示词,新模型上线先跑探针再切流。
VNC 图形验收:OAuth、Gateway、浏览器 MCP 与权限弹窗在远程 Mac 图形会话中与 Agent 同机核对。
从 0 到 1 接入多模型。
阅读 →中国模型 61% 与 Q3 预测。
阅读 →7 月下旬两大热点。
阅读 →不是。它按真实付费 Token 用量排序。难任务消费份额上 Claude Sonnet 4.6 与 Opus 4.7 仍并列领先。
截至 7 月 25 日,小米 Mimo V2.5 约 1.4T Token/天 居首,其次是 DeepSeek V4 Flash 与腾讯 Hy3。
综合约 46%,一年前不到 2%;美国三巨头合计约 30%–36%。
Nous Research 的开源自我迭代智能体在 Apps 榜约占 45%,反映个人 Agent / CLI 自动化的高频调用特征。
7 月榜单最值得记住的一句话:capability(能力)与 popularity(用量)正在分道扬镳。中国开源模型靠价格拿下流量半壁江山,美国闭源旗舰仍守着难任务定价权与安全声誉护城河。
若你主力机在 Windows/Linux,又要在 macOS 上跑 Claude Code、OpenClaw 或 Kilo Code 做多模型验收,自建 Mac 有折旧与睡眠成本,纯 SSH 又难处理 OAuth 与系统权限弹窗。租用 VNCMac 远程 Mac + VNC 图形会话可在与 Gateway 同机环境下对照 OpenRouter Dashboard 做分层路由验收,把「跟榜」变成可复现工作流。
数据截止 2026 年 7 月 25 日,发布前请以 openrouter.ai/rankings 实时数据为准。