Реальный объём токенов · 46 % китайская доля · Трафик vs качество · Слой Apps · Прогноз на август
Если вы всё ещё выбираете LLM по бенчмарку двухмесячной давности — вы уже отстаёте. Кратко: OpenRouter не оценивает лаборатории — он маршрутизирует реальный платный трафик. На 25 июля 2026 Mimo V2.5 от Xiaomi лидирует с ~1,4 Т токенов/сутки, китайские лабы держат ~46 % объёма, и место в рейтинге по использованию — не сигнал качества — рынок раскалывается на гантель из дешёвого open-weight объёма и pricing power закрытых frontier на сложных задачах. В этом гайде: топ-12 моделей, доля провайдеров, рейтинг Apps (Hermes / Kilo Code / OpenClaw), прогноз на август, советы по маршрутизации по ролям и пятиступенчатый чеклист Mac. См. также наш обзор рейтингов за июнь и гайд по API OpenRouter.
На 25 июля топ-3 моделей по суточному объёму токенов — Mimo V2.5 (1,4 Т/сут), DeepSeek V4 Flash (943,9 млрд/сут) и Tencent Hy3 (590 млрд/сут). Семь из десяти лучших моделей — китайские; NVIDIA Nemotron 3 Ultra, Claude и Gemini по-прежнему якорят US-сторону.
| Место | Модель | Лаб | Токены/сут | Итого 30 дн |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4 Т | 31,2 Т |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9 млрд | 23,6 Т |
| 3 | Hy3 | Tencent | 590 млрд | 23,4 Т |
| 4 | Nemotron 3 Ultra 550B (бесплатно) | NVIDIA | 428,6 млрд | 9 Т |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7 млрд | 11,6 Т |
| 6 | GLM 5.2 | Z.ai | 316,7 млрд | 13,3 Т |
| 7 | MiniMax M3 | MiniMax | 262,5 млрд | 15,1 Т |
| 8 | Step 3.7 Flash | StepFun | 204,8 млрд | 5,9 Т |
| 9 | Kimi K3 | Moonshot | 157,6 млрд | 1,6 Т (новый) |
| 10 | Ling 3.0 Flash | InclusionAI | 128,3 млрд | 417,3 млрд |
| 11 | Gemini 3 Flash Preview | 106,3 млрд | 4 Т | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5 млрд | 3,6 Т |
На уровне провайдеров китайские лабы теперь составляют ~46 % идентифицированного объёма токенов — против менее 2 % год назад. US-лабы (OpenAI, Anthropic, Google) упали с ~70 % в середине 2025 до 30–36 %. Это математика цен: DeepSeek V4 Flash стоит около $0,05–0,14/М на вход против GPT-5.5 около $5/М — разрыв примерно 35×.
Для цитирования: DeepSeek остаётся самым стабильным провайдером №1 (~16–18 %), но «модель месяца» продолжает меняться — MiniMax M2.5 в феврале, MiMo-V2-Pro в апреле, Mimo V2.5 в июле.
Дешёвая быстрая модель, подключённая к одному высоконагруженному consumer-приложению, может обогнать более способную модель, зарезервированную для самых сложных 10 % работы.
Путать объём с возможностями: Roleplay, чат и лёгкий код доминируют в open-model трафике — не enterprise-сложное рассуждение.
Игнорировать структуру расходов: По категориям чат — 35,7 %, agentic workflows — 30,4 %, код — 26,5 % — но в Classification Claude Sonnet 4.6 и Opus 4.7 делят лидерство с 13,5 % расходов каждый.
Суточная волатильность: Claude Opus 4.8 был в топ-10 24.07; Ling 3.0 Flash вытеснил его из топ-12 к 25.07. Всегда указывайте дату среза.
Растущий вес безопасности: Раскрытие OpenAI об escape из sandbox на этой неделе выведет «трек-рекорд безопасности вендора» в enterprise-скоркарды.
Блокировка на одной модели: Claude Opus 5 (24 июля) лидирует FrontierBench v0.1 с 43,3 % при Opus-цене $5/$25 — frontier-лабы сохраняют pricing power на сложных задачах.
| Сегмент | Типичные нагрузки | Рейтинг по объёму | Расходы на сложные задачи |
|---|---|---|---|
| Высокий объём, толерантный | Чат, креатив, roleplay, рутинный код | Китайские open Flash-модели | Низкая доля |
| Низкая толерантность, высокая ценность | Сложное рассуждение, планирование агента, классификация | Редко топ-10 | Claude / GPT frontier |
Рейтинги моделей показывают, какой «мозг» популярен. Рейтинг Apps показывает, что этот мозг делает:
| Место | Приложение | Тип | Доля (~) |
|---|---|---|---|
| 1 | Hermes Agent | Личный / CLI-агент | ~45 % |
| 2 | Kilo Code | Coding-агент | ~13 % |
| 3 | OpenClaw | Универсальный агент | ~9 % |
| 4 | Claude Code | Coding-агент | ~6 % |
| 5 | Descript | Контент | ~4,5 % |
| 6–10 | pi, Lemonade, ISEKAI ZERO, Janitor AI, Cline | Агент / companion / roleplay | ~1,7 %–3,3 % каждый |
Cline → Roo Code → Kilo Code — три форка одной линии; младший форк Kilo Code обогнал обоих предков. Преимущество first-mover в open-source dev-инструментах явно не вечно.
Отчёт State of AI от OpenRouter × a16z показал, что креативный roleplay составляет более половины использования open-моделей. Если ваш взгляд на ИИ исходит только из enterprise-заголовков — вы упускаете половину рынка.
Доля китайских open-weight, вероятно, вырастет к 50 % и выше, если крупный US-провайдер не снизит цены.
Ежемесячный №1 будет продолжать меняться между Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax и Moonshot.
Anthropic может выпустить более дешёвый volume-tier — Opus 5 их четвёртый flagship менее чем за два месяца.
Веса Kimi K3 на 1,4 ТБ должны получить community-квантизацию за 2–4 недели.
Безопасность и governance станут критериями выбора — законодательство US «AI Kill Switch» и рамка предрелизной проверки Белого дома ожидаются до августа.
| Модель | Вход/М | Выход/М | Позиционирование |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0,05–0,14 | ~$0,24–0,28 | Лучшая ценность; agentic coding |
| MiniMax M3 | $0,10 | $1,21 | Длинный контекст на бюджете |
| GLM 5.2 | $0,45 | $3,31 | Open-weight планирование в стиле Opus |
| Kimi K3 | ~$3 | ~$15 | 1,4 ТБ открытых весов |
| Claude Opus 5 | $5 (fast $10) | $25 (fast $50) | Закрытый frontier; сложные задачи |
| Роль | Рекомендуемый подход |
|---|---|
| Инди / малая команда | Используйте OpenRouter как песочницу; начните код на DeepSeek V4 Flash и GLM 5.2, резервируйте Opus 5 / GPT-5.6 для шагов, которые реально падают |
| Lead инфраструктуры | Не выбирайте только по месту в рейтинге; тируйте маршруты по риску задачи и добавьте безопасность вендора в скоркарды |
| Разработчик агентов / devtool | Изучите историю форка Kilo Code; объём companion/развлечений реален, даже если невидим в enterprise-прессе |
На Mac с Claude Code, OpenClaw или Kilo Code внедряйте barbell-маршрутизацию по порядку:
Тируйте задачи: S-tier (сложнейшие 5 %) → закрытые frontier-модели; A-tier → DeepSeek / GLM; B-tier → класс Flash.
Единый роутер: OpenRouter или конфиг models OpenClaw — без захардкоженного провайдера в коде приложения.
Алерты расходов: Дневные/недельные лимиты на модель, чтобы агенты не зацикливались на Opus по ошибке.
Качественные пробы: 10–20 фиксированных регрессионных промптов перед переключением трафика на новую модель.
VNC-приёмка: OAuth, Gateway, browser MCP и диалоги разрешений проверены в графической Mac-сессии, co-located с агентом.
Один ключ, 400+ моделей.
Читать →61 % китайская доля и прогноз Q3.
Читать →Двойные заголовки конца июля.
Читать →Нет — сортирует по платному объёму токенов. По расходам на сложные задачи Claude Sonnet 4.6 и Opus 4.7 по-прежнему делят лидерство.
На 25 июля Xiaomi Mimo V2.5 с ~1,4 Т токенов/сутки, затем DeepSeek V4 Flash и Tencent Hy3.
Около 46 % суммарно, против менее 2 % год назад; US-лабы держатся на 30–36 %.
Open self-improving агент Nous Research держит ~45 % токенов приложений — высокочастотная личная автоматизация, а не голос за качество.
Главная мысль июля: возможности и популярность расходятся. Китайские open-weight модели купили половину рынка ценой; US closed-frontier лабы защищают другую половину на сложных задачах и доверии к безопасности.
Если ваш daily driver — Windows или Linux, но нужен macOS для Claude Code, OpenClaw или Kilo Code, покупка Mac добавляет амортизацию и overhead политики сна; SSH-only пропускает OAuth и диалоги разрешений. Аренда удалённого Mac VNCMac с VNC позволяет валидировать barbell-маршрутизацию по дашборду OpenRouter на той же машине, что и ваш Gateway.
Данные на 25 июля 2026 — проверяйте актуальные цифры на openrouter.ai/rankings перед цитированием.