Тренды LLM 27 июля 2026 ~16 мин чтения OpenRouter DeepSeek

Рейтинги OpenRouter июль 2026
Кто на самом деле выигрывает гонку ИИ-моделей

Реальный объём токенов · 46 % китайская доля · Трафик vs качество · Слой Apps · Прогноз на август

График рейтингов OpenRouter июль 2026 с долей китайских моделей на рынке

Если вы всё ещё выбираете LLM по бенчмарку двухмесячной давности — вы уже отстаёте. Кратко: OpenRouter не оценивает лаборатории — он маршрутизирует реальный платный трафик. На 25 июля 2026 Mimo V2.5 от Xiaomi лидирует с ~1,4 Т токенов/сутки, китайские лабы держат ~46 % объёма, и место в рейтинге по использованию — не сигнал качества — рынок раскалывается на гантель из дешёвого open-weight объёма и pricing power закрытых frontier на сложных задачах. В этом гайде: топ-12 моделей, доля провайдеров, рейтинг Apps (Hermes / Kilo Code / OpenClaw), прогноз на август, советы по маршрутизации по ролям и пятиступенчатый чеклист Mac. См. также наш обзор рейтингов за июнь и гайд по API OpenRouter.

01

Рейтинг июля: Xiaomi на №1, китайские лабы пересекли 46 %

На 25 июля топ-3 моделей по суточному объёму токенов — Mimo V2.5 (1,4 Т/сут), DeepSeek V4 Flash (943,9 млрд/сут) и Tencent Hy3 (590 млрд/сут). Семь из десяти лучших моделей — китайские; NVIDIA Nemotron 3 Ultra, Claude и Gemini по-прежнему якорят US-сторону.

МестоМодельЛабТокены/сутИтого 30 дн
1Mimo V2.5Xiaomi1,4 Т31,2 Т
2DeepSeek V4 FlashDeepSeek943,9 млрд23,6 Т
3Hy3Tencent590 млрд23,4 Т
4Nemotron 3 Ultra 550B (бесплатно)NVIDIA428,6 млрд9 Т
5DeepSeek V4 ProDeepSeek413,7 млрд11,6 Т
6GLM 5.2Z.ai316,7 млрд13,3 Т
7MiniMax M3MiniMax262,5 млрд15,1 Т
8Step 3.7 FlashStepFun204,8 млрд5,9 Т
9Kimi K3Moonshot157,6 млрд1,6 Т (новый)
10Ling 3.0 FlashInclusionAI128,3 млрд417,3 млрд
11Gemini 3 Flash PreviewGoogle106,3 млрд4 Т
12Claude Sonnet 5Anthropic99,5 млрд3,6 Т

На уровне провайдеров китайские лабы теперь составляют ~46 % идентифицированного объёма токенов — против менее 2 % год назад. US-лабы (OpenAI, Anthropic, Google) упали с ~70 % в середине 2025 до 30–36 %. Это математика цен: DeepSeek V4 Flash стоит около $0,05–0,14/М на вход против GPT-5.5 около $5/М — разрыв примерно 35×.

Для цитирования: DeepSeek остаётся самым стабильным провайдером №1 (~16–18 %), но «модель месяца» продолжает меняться — MiniMax M2.5 в феврале, MiMo-V2-Pro в апреле, Mimo V2.5 в июле.

02

Что упускает большинство обзоров: место в рейтинге — не сигнал качества

Дешёвая быстрая модель, подключённая к одному высоконагруженному consumer-приложению, может обогнать более способную модель, зарезервированную для самых сложных 10 % работы.

Пять издержек неверного чтения рейтинга

  1. 01

    Путать объём с возможностями: Roleplay, чат и лёгкий код доминируют в open-model трафике — не enterprise-сложное рассуждение.

  2. 02

    Игнорировать структуру расходов: По категориям чат — 35,7 %, agentic workflows — 30,4 %, код — 26,5 % — но в Classification Claude Sonnet 4.6 и Opus 4.7 делят лидерство с 13,5 % расходов каждый.

  3. 03

    Суточная волатильность: Claude Opus 4.8 был в топ-10 24.07; Ling 3.0 Flash вытеснил его из топ-12 к 25.07. Всегда указывайте дату среза.

  4. 04

    Растущий вес безопасности: Раскрытие OpenAI об escape из sandbox на этой неделе выведет «трек-рекорд безопасности вендора» в enterprise-скоркарды.

  5. 05

    Блокировка на одной модели: Claude Opus 5 (24 июля) лидирует FrontierBench v0.1 с 43,3 % при Opus-цене $5/$25 — frontier-лабы сохраняют pricing power на сложных задачах.

СегментТипичные нагрузкиРейтинг по объёмуРасходы на сложные задачи
Высокий объём, толерантныйЧат, креатив, roleplay, рутинный кодКитайские open Flash-моделиНизкая доля
Низкая толерантность, высокая ценностьСложное рассуждение, планирование агента, классификацияРедко топ-10Claude / GPT frontier
03

Слой Apps: coding-агенты доминируют; roleplay — невидимая половина

Рейтинги моделей показывают, какой «мозг» популярен. Рейтинг Apps показывает, что этот мозг делает:

МестоПриложениеТипДоля (~)
1Hermes AgentЛичный / CLI-агент~45 %
2Kilo CodeCoding-агент~13 %
3OpenClawУниверсальный агент~9 %
4Claude CodeCoding-агент~6 %
5DescriptКонтент~4,5 %
6–10pi, Lemonade, ISEKAI ZERO, Janitor AI, ClineАгент / companion / roleplay~1,7 %–3,3 % каждый

Cline → Roo Code → Kilo Code — три форка одной линии; младший форк Kilo Code обогнал обоих предков. Преимущество first-mover в open-source dev-инструментах явно не вечно.

Отчёт State of AI от OpenRouter × a16z показал, что креативный roleplay составляет более половины использования open-моделей. Если ваш взгляд на ИИ исходит только из enterprise-заголовков — вы упускаете половину рынка.

04

Прогноз на август и снимок цен

  1. 01

    Доля китайских open-weight, вероятно, вырастет к 50 % и выше, если крупный US-провайдер не снизит цены.

  2. 02

    Ежемесячный №1 будет продолжать меняться между Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax и Moonshot.

  3. 03

    Anthropic может выпустить более дешёвый volume-tier — Opus 5 их четвёртый flagship менее чем за два месяца.

  4. 04

    Веса Kimi K3 на 1,4 ТБ должны получить community-квантизацию за 2–4 недели.

  5. 05

    Безопасность и governance станут критериями выбора — законодательство US «AI Kill Switch» и рамка предрелизной проверки Белого дома ожидаются до августа.

Репрезентативные цены (июль 2026)

МодельВход/МВыход/МПозиционирование
DeepSeek V4 Flash~$0,05–0,14~$0,24–0,28Лучшая ценность; agentic coding
MiniMax M3$0,10$1,21Длинный контекст на бюджете
GLM 5.2$0,45$3,31Open-weight планирование в стиле Opus
Kimi K3~$3~$151,4 ТБ открытых весов
Claude Opus 5$5 (fast $10)$25 (fast $50)Закрытый frontier; сложные задачи
05

Рекомендации по ролям + пятиступенчатый чеклист маршрутизации Mac

РольРекомендуемый подход
Инди / малая командаИспользуйте OpenRouter как песочницу; начните код на DeepSeek V4 Flash и GLM 5.2, резервируйте Opus 5 / GPT-5.6 для шагов, которые реально падают
Lead инфраструктурыНе выбирайте только по месту в рейтинге; тируйте маршруты по риску задачи и добавьте безопасность вендора в скоркарды
Разработчик агентов / devtoolИзучите историю форка Kilo Code; объём companion/развлечений реален, даже если невидим в enterprise-прессе

На Mac с Claude Code, OpenClaw или Kilo Code внедряйте barbell-маршрутизацию по порядку:

  1. 01

    Тируйте задачи: S-tier (сложнейшие 5 %) → закрытые frontier-модели; A-tier → DeepSeek / GLM; B-tier → класс Flash.

  2. 02

    Единый роутер: OpenRouter или конфиг models OpenClaw — без захардкоженного провайдера в коде приложения.

  3. 03

    Алерты расходов: Дневные/недельные лимиты на модель, чтобы агенты не зацикливались на Opus по ошибке.

  4. 04

    Качественные пробы: 10–20 фиксированных регрессионных промптов перед переключением трафика на новую модель.

  5. 05

    VNC-приёмка: OAuth, Gateway, browser MCP и диалоги разрешений проверены в графической Mac-сессии, co-located с агентом.

Читать далее
FAQ

Часто задаваемые вопросы

Нет — сортирует по платному объёму токенов. По расходам на сложные задачи Claude Sonnet 4.6 и Opus 4.7 по-прежнему делят лидерство.

На 25 июля Xiaomi Mimo V2.5 с ~1,4 Т токенов/сутки, затем DeepSeek V4 Flash и Tencent Hy3.

Около 46 % суммарно, против менее 2 % год назад; US-лабы держатся на 30–36 %.

Open self-improving агент Nous Research держит ~45 % токенов приложений — высокочастотная личная автоматизация, а не голос за качество.

Итог

Главная мысль июля: возможности и популярность расходятся. Китайские open-weight модели купили половину рынка ценой; US closed-frontier лабы защищают другую половину на сложных задачах и доверии к безопасности.

Если ваш daily driver — Windows или Linux, но нужен macOS для Claude Code, OpenClaw или Kilo Code, покупка Mac добавляет амортизацию и overhead политики сна; SSH-only пропускает OAuth и диалоги разрешений. Аренда удалённого Mac VNCMac с VNC позволяет валидировать barbell-маршрутизацию по дашборду OpenRouter на той же машине, что и ваш Gateway.

Данные на 25 июля 2026 — проверяйте актуальные цифры на openrouter.ai/rankings перед цитированием.