12–17 августа 2026 · пик свыше 1100% · 2,4 трлн открытых весов · то же основание, пост-обучение
Ввод: За пять дней три ведущие китайские лаборатории сделали ходы, которые снаружи противоречат друг другу, а внутри рифмуются. DeepSeek поднял отдельные ступени API до 1100%. Alibaba в ту же неделю открыла флагман на 2,4 трлн параметров, который раньше не выпускался весами. Zhipu выпустила GLM-5.3 и примерно вшестеро подняла кодовые бенчмарки на том же основании — без нового предобучения. Вместе это сигнал: китайские модели уходят от войны цен к войне за власть над ценой. Читайте вместе с обзором V4-Flash, заметкой о Qwen3.8-Max и снижением GPT-5.6.
Заголовок — не счёт. 1100% относятся только к пиковому cache-hit входу. Выход — строка большинства счетов — вырос на 350%.
Официальный тариф больше не автоматически самый дешёвый. В пик собственный API выше части реселлеров (GMI Cloud, Novita и другие всё ещё ниже нового пика).
Открытые веса — не Apache 2.0. Qwen3.8-Max своей лицензией держит рычаг над крупным MaaS и ИИ-помощниками.
«Китайская модель = самая дешёвая» ломается. Вне пика DeepSeek всё ещё ниже Opus 5, но международный Qwen и Luna выигрывают хотя бы по одной оси.
| Дата | Событие |
|---|---|
| 16 июля 2026 | Moonshot открыла Kimi K3 (2,8 трлн параметров), уже под вниманием США по безопасности |
| 2–3 августа 2026 | Alibaba анонсировала, затем запустила Qwen3.8-Max как облачный API |
| 10 августа 2026 | Meta выпустила Muse Glimmer (30 млрд, Apache 2.0) и анонсировала веса флагмана Muse Spark 1.2 |
| 12 августа 2026 | Alibaba выложила Qwen3.8-2.4T-A95B на Hugging Face/ModelScope; xAI выпустила Grok 4.6 |
| 13 августа 2026 | DeepSeek-V4-Pro вышла в GA и объявила повышение с 17 августа; Google снизила Gemini 3.7 Flash |
| 14 августа 2026 | Zhipu выпустила GLM-5.3, база как у GLM-5.2: 743 млрд |
| 17 августа 2026, 00:00 Пекин | Новые тарифы DeepSeek вступили в силу |
Дальше: 30 июля OpenAI срезала самый дешёвый ярус GPT-5.6 Luna на 80%, 6–7 августа сделала Luna умолчанием для бесплатных пользователей с безлимитным текстом. Пока китайские лаборатории поднимали цены и открывали флагманские веса, американские резали цены и уходили в бесплатность на потребительском слое. Это не совпадение, а две стороны одной ценовой войны.
| Позиция (за 1 млн токенов) | Было | Вне пика (новое) | Пик (новое) | Рост в пик |
|---|---|---|---|---|
| V4-Flash cache hit (вход) | ¥0,02 | ¥0,05 | ¥0,10 | ~400% |
| V4-Flash cache miss (вход) | ¥1,0 | ¥1,5 | ¥3,0 | 200% |
| V4-Flash выход | ¥2,0 | ¥4,5 | ¥9,0 | 350% |
| V4-Pro cache hit (вход) | ¥0,025 | ¥0,15 | ¥0,30 | ~1100% |
| V4-Pro cache miss (вход) | ¥3,0 | ¥4,5 | ¥9,0 | 200% |
| V4-Pro выход | ¥6,0 | ¥13,5 | ¥27,0 | 350% |
Заголовочные 1100% относятся только к пиковому cache-hit входу — ступени, что начиналась почти с нуля. Выход, который держит реальные счета, вырос на 350%. Сторонние модели для тяжёлой нагрузки (около 84 млн токенов/мес, в основном вне пика, половина попаданий) дают рост ближе к 1,8x.
| Пункт | Деталь |
|---|---|
| Параметры | 2,4 трлн всего, 95 млрд активных (MoE, 512 экспертов, 10 маршрутизируемых + 1 общий) |
| Контекст | 262 144 токена нативно, до ~1,01 млн; облачный Max по умолчанию 1 млн |
| Ритм | Анонс 2 авг. → API 3 авг. → веса 12 авг. |
| Международный API | 2 $ вход / 6 $ выход за миллион |
| Лицензия | Не Apache 2.0 — своя Qwen3.8-Max License |
| Смысл | Первый Max-флагман Alibaba в весах; 3.5/3.6/3.7 Max оставались только API |
| Бенчмарк | GLM-5.2 | GLM-5.3 | Изменение |
|---|---|---|---|
| Terminal-Bench 3.0 | 4,6% | 28,3% | +23,7 |
| DeepSWE v1.1 | 46,2% | 66,9% | +20,7 |
| Agents' Last Exam (CLI) | 23,8% | 28,5% | +4,7 |
| CyberGym | 77,2% | 84,5% | +7,3 |
| AutomationBench | 26,2% | 48,2% | +22,0 |
Это собственные цифры Zhipu, независимого прогона нет. На Terminal-Bench 3.0 GLM-5.3 отстаёт от GPT-5.6 Sol (34,6%) и Claude Fable 5 (33,7%): верх открытых весов, не победа frontier.
Самое простое прочтение — «самая дешёвая китайская модель сдалась марже». Структура ближе к первой явной вычислительной квитанции. Старый всегда дешёвый тариф работал как привлечение, пока GPU успевали за спросом. Когда вызовы росли экспоненциально, а мощность нет, что-то пришлось назвать. «Более гибкое планирование нагрузки» значит: пиковых вычислений не хватает, сдвиньте сами.
В пик официальный API дороже части реселлеров. Допущение «официал всегда самый дешёвый DeepSeek» сломано впервые.
Открытие — не простое благодеяние. Alibaba выложила чекпоинт на 2,4 трлн и прикрепила свою лицензию: MaaS или ИИ-помощник с выручкой свыше 50 млн долларов за 12 месяцев требует отдельной коммерческой сделки; продукты с MAU свыше 100 млн или месячной выручкой свыше 20 млн долларов должны явно показывать имя модели.
Отдать веса за умы разработчиков (особенно за рубежом) и оставить рычаг тем, кто способен построить конкурирующий инференс. Это другая ставка, чем Muse Glimmer на чистом Apache 2.0. Слух о запрете скачивания из США, ЕС, Великобритании и Южной Кореи ложен: в тексте нет территориальной оговорки.
Интересен не балл, а способ: та же база 743 млрд, что у 5.2, без нового предобучения, примерно 6x на Terminal-Bench 3.0 (4,6% → 28,3%) только за счёт расширения RL-сред. Когда отдача предобучения падает, масштаб пост-обучения становится отдельным рычагом с куда более низким порогом, чем новое фундаментное обучение.
| Модель | Вход (за 1 млн) | Выход (за 1 млн) | Открытые веса? |
|---|---|---|---|
| DeepSeek V4-Pro (пик) | ¥9,0 (~1,26 $) | ¥27,0 (~3,78 $) | Нет |
| DeepSeek V4-Pro (вне пика) | ¥4,5 (~0,63 $) | ¥13,5 (~1,89 $) | Нет |
| Qwen3.8-Max (международный) | 2,00 $ | 6,00 $ | Да (своя лицензия) |
| OpenAI GPT-5.6 Luna | 0,20 $ | 1,20 $ | Нет |
| Claude Opus 5 (оценка по кратности Alibaba) | ~5,00 $ | ~25,00 $ | Нет |
Курс около ¥7,15 за доллар. Короткий ответ: нет. Внепиковый V4-Pro всё ещё заметно ниже Opus 5, но уже не самый дешёвый на столе. Международный Qwen и Luna обходят внепиковый тариф. Равенство «китайская = самая дешёвая» держалось в 2025 и начале 2026; это больше не безопасное допущение.
В более широкой рамке виден узор. Примерно месяц китайские лидеры выпускают в темпе, который внутренняя финансовая пресса зовёт «три обновления в неделю» (一周三更) — DeepSeek, Alibaba, Zhipu, плюс Kimi K3 (16 июля, 2,8 трлн) и MiniMax H3. Китайские материалы жёстче англоязычных продуктовых заметок: «китайские открытые веса заставляют мир пересчитать цену ИИ».
Американские лаборатории играют наоборот на потребительском слое: OpenAI 30 июля срезала самый дешёвый ярус на 80% и через неделю сделала его бесплатным и безлимитным; Google 13 августа выпустила кодовую модель вдвое дешевле трёхнедельного предшественника. Китай открывает флагманы и ступенчато поднимает верх, США бегут к бесплатному и дешёвому внизу. Обе стратегии настоящие; они оптимизируют разные этажи воронки.
Есть и геополитический слой. Открытие Kimi K3 уже вызвало интерес США по безопасности; окно Alibaba для флагмана на 2,4 трлн часть аналитиков читает как закрепление международной паритетной истории до возможного ужесточения. Это интерпретация, не установленный факт — но контекст, который чисто англоязычные продуктовые новости часто пропускают.
Привязать заголовок к строке: cache-hit вход, miss-вход или выход.
Сдвинуть пакетные агент-задачи, оценки и регрессии с пекинских 9–12 и 14–18.
Зафиксировать системные промпты и переиспользовать длинные префиксы, чтобы не платить miss + выход дважды.
Прочитать лицензию Qwen3.8-Max: личное и внутреннее обычно свободно; MaaS/помощник свыше 50 млн долларов за 12 месяцев требует сделки.
Не выбирать кодового агента по размеру базы — GLM-5.3 даёт почти 6x на том же основании.
Прогнать тот же поток OpenClaw на отдельном удалённом Mac против DeepSeek вне пика, международного Qwen и GLM, затем зафиксировать умолчание после реальной недели счетов.
Вне пика он всё ещё дешевле Claude Opus 5, но уже не самый дешёвый вариант в целом. GPT-5.6 Luna (0,20/1,20 $ за миллион токенов) и международный Qwen3.8-Max (2/6 $) обходят новый внепиковый тариф DeepSeek хотя бы по одной оси. Для frontier-класса DeepSeek всё ещё относительно дёшев, просто больше не однозначно самый дешёвый.
В большинстве случаев да: личные проекты и внутренняя эксплуатация не затронуты. Исключение — Model-as-a-Service или ИИ-помощник с выручкой свыше 50 млн долларов за 12 месяцев; тогда нужна отдельная коммерческая лицензия Alibaba.
Нет. В опубликованном тексте нет географических ограничений. Барьеры привязаны к выручке, а не к месту.
На уровне базы — ничем: оба на 743 млрд параметров. Прирост (примерно 6x на Terminal-Bench 3.0) целиком из масштабированного RL в пост-обучении, без нового предобучения.
Пока нет. Glimmer — дистиллят на 30 млрд. Цукерберг анонсировал открытые веса Muse Spark 1.2; это намерение, а не состоявшийся релиз.
Как только почасовой тариф жив, ноутбук или долгоживущий офисный Mac показывают две дыры: пик плохо сдвигается, три счёта не садятся рядом в одной графической сессии агента. Гнаться за заголовком 1100% или читать открытые веса как свободную коммерческую лицензию превращает скрытую стоимость в счёт следующего месяца. Маршрутизацию DeepSeek / Qwen / GLM, префиксы кэша и внепиковые задачи лучше вынести на удалённый Mac, который можно выключить после опыта. Арендуйте удалённый Mac VNCMac, прогоните OpenClaw вне пика и в пик, затем зафиксируйте умолчание. Начните с тарифов Mac; как вычислительный счёт переходит в цену — в заметке о втором раунде DeepSeek.
Источники: официальное объявление тарифов DeepSeek, сверка с Wall Street CN, IT Home, AIGC.cn и V2EX; официальные репозитории Qwen Alibaba (Hugging Face / ModelScope) и SCMP по лицензии; техническая страница GLM-5.3 Zhipu (Z.ai), VentureBeat и StableLearn; блог Meta AI Research и VentureBeat о Muse Glimmer; Yicai и Sohu Finance о ритме китайских open-weight релизов. Цены, лицензии и бенчмарки — публичные данные на дату публикации. Перед перепечаткой сверяйте актуальные официальные тексты; чипы, уязвимость Cursor и слухи об экспорте остаются неподтверждёнными.