Цены ИИ 17 августа 2026 около 18 мин DeepSeek Qwen3.8

Почему DeepSeek поднял API до 1100%
сразу после китайской open-weight волны

12–17 августа 2026 · пик свыше 1100% · 2,4 трлн открытых весов · то же основание, пост-обучение

Стойки ЦОД с синими индикаторами: ёмкость инференса и давление API-цен

Ввод: За пять дней три ведущие китайские лаборатории сделали ходы, которые снаружи противоречат друг другу, а внутри рифмуются. DeepSeek поднял отдельные ступени API до 1100%. Alibaba в ту же неделю открыла флагман на 2,4 трлн параметров, который раньше не выпускался весами. Zhipu выпустила GLM-5.3 и примерно вшестеро подняла кодовые бенчмарки на том же основании — без нового предобучения. Вместе это сигнал: китайские модели уходят от войны цен к войне за власть над ценой. Читайте вместе с обзором V4-Flash, заметкой о Qwen3.8-Max и снижением GPT-5.6.

01

Четыре болевые точки до таблиц

  1. 01

    Заголовок — не счёт. 1100% относятся только к пиковому cache-hit входу. Выход — строка большинства счетов — вырос на 350%.

  2. 02

    Официальный тариф больше не автоматически самый дешёвый. В пик собственный API выше части реселлеров (GMI Cloud, Novita и другие всё ещё ниже нового пика).

  3. 03

    Открытые веса — не Apache 2.0. Qwen3.8-Max своей лицензией держит рычаг над крупным MaaS и ИИ-помощниками.

  4. 04

    «Китайская модель = самая дешёвая» ломается. Вне пика DeepSeek всё ещё ниже Opus 5, но международный Qwen и Luna выигрывают хотя бы по одной оси.

02

Хронология: что и когда

ДатаСобытие
16 июля 2026Moonshot открыла Kimi K3 (2,8 трлн параметров), уже под вниманием США по безопасности
2–3 августа 2026Alibaba анонсировала, затем запустила Qwen3.8-Max как облачный API
10 августа 2026Meta выпустила Muse Glimmer (30 млрд, Apache 2.0) и анонсировала веса флагмана Muse Spark 1.2
12 августа 2026Alibaba выложила Qwen3.8-2.4T-A95B на Hugging Face/ModelScope; xAI выпустила Grok 4.6
13 августа 2026DeepSeek-V4-Pro вышла в GA и объявила повышение с 17 августа; Google снизила Gemini 3.7 Flash
14 августа 2026Zhipu выпустила GLM-5.3, база как у GLM-5.2: 743 млрд
17 августа 2026, 00:00 ПекинНовые тарифы DeepSeek вступили в силу

Дальше: 30 июля OpenAI срезала самый дешёвый ярус GPT-5.6 Luna на 80%, 6–7 августа сделала Luna умолчанием для бесплатных пользователей с безлимитным текстом. Пока китайские лаборатории поднимали цены и открывали флагманские веса, американские резали цены и уходили в бесплатность на потребительском слое. Это не совпадение, а две стороны одной ценовой войны.

03

Цифры: что изменилось по сути

Повышение DeepSeek по строкам (с 17 августа, 00:00 Пекин; пик 9–12 и 14–18 по Пекину)

Позиция (за 1 млн токенов)БылоВне пика (новое)Пик (новое)Рост в пик
V4-Flash cache hit (вход)¥0,02¥0,05¥0,10~400%
V4-Flash cache miss (вход)¥1,0¥1,5¥3,0200%
V4-Flash выход¥2,0¥4,5¥9,0350%
V4-Pro cache hit (вход)¥0,025¥0,15¥0,30~1100%
V4-Pro cache miss (вход)¥3,0¥4,5¥9,0200%
V4-Pro выход¥6,0¥13,5¥27,0350%

Заголовочные 1100% относятся только к пиковому cache-hit входу — ступени, что начиналась почти с нуля. Выход, который держит реальные счета, вырос на 350%. Сторонние модели для тяжёлой нагрузки (около 84 млн токенов/мес, в основном вне пика, половина попаданий) дают рост ближе к 1,8x.

Qwen3.8-2.4T-A95B: ключевые характеристики

ПунктДеталь
Параметры2,4 трлн всего, 95 млрд активных (MoE, 512 экспертов, 10 маршрутизируемых + 1 общий)
Контекст262 144 токена нативно, до ~1,01 млн; облачный Max по умолчанию 1 млн
РитмАнонс 2 авг. → API 3 авг. → веса 12 авг.
Международный API2 $ вход / 6 $ выход за миллион
ЛицензияНе Apache 2.0 — своя Qwen3.8-Max License
СмыслПервый Max-флагман Alibaba в весах; 3.5/3.6/3.7 Max оставались только API

GLM-5.3 против 5.2: та же база, только пост-обучение

БенчмаркGLM-5.2GLM-5.3Изменение
Terminal-Bench 3.04,6%28,3%+23,7
DeepSWE v1.146,2%66,9%+20,7
Agents' Last Exam (CLI)23,8%28,5%+4,7
CyberGym77,2%84,5%+7,3
AutomationBench26,2%48,2%+22,0

Это собственные цифры Zhipu, независимого прогона нет. На Terminal-Bench 3.0 GLM-5.3 отстаёт от GPT-5.6 Sol (34,6%) и Claude Fable 5 (33,7%): верх открытых весов, не победа frontier.

04

Три стратегии, три логики

DeepSeek: от плоского тарифа к времени суток — это дефицит мощности

Самое простое прочтение — «самая дешёвая китайская модель сдалась марже». Структура ближе к первой явной вычислительной квитанции. Старый всегда дешёвый тариф работал как привлечение, пока GPU успевали за спросом. Когда вызовы росли экспоненциально, а мощность нет, что-то пришлось назвать. «Более гибкое планирование нагрузки» значит: пиковых вычислений не хватает, сдвиньте сами.

В пик официальный API дороже части реселлеров. Допущение «официал всегда самый дешёвый DeepSeek» сломано впервые.

Alibaba: веса покупают экосистему, лицензия держит потолок

Открытие — не простое благодеяние. Alibaba выложила чекпоинт на 2,4 трлн и прикрепила свою лицензию: MaaS или ИИ-помощник с выручкой свыше 50 млн долларов за 12 месяцев требует отдельной коммерческой сделки; продукты с MAU свыше 100 млн или месячной выручкой свыше 20 млн долларов должны явно показывать имя модели.

Отдать веса за умы разработчиков (особенно за рубежом) и оставить рычаг тем, кто способен построить конкурирующий инференс. Это другая ставка, чем Muse Glimmer на чистом Apache 2.0. Слух о запрете скачивания из США, ЕС, Великобритании и Южной Кореи ложен: в тексте нет территориальной оговорки.

GLM-5.3: база та же, рецепт пост-обучения другой

Интересен не балл, а способ: та же база 743 млрд, что у 5.2, без нового предобучения, примерно 6x на Terminal-Bench 3.0 (4,6% → 28,3%) только за счёт расширения RL-сред. Когда отдача предобучения падает, масштаб пост-обучения становится отдельным рычагом с куда более низким порогом, чем новое фундаментное обучение.

05

Сравнение: DeepSeek всё ещё самый дешёвый frontier?

МодельВход (за 1 млн)Выход (за 1 млн)Открытые веса?
DeepSeek V4-Pro (пик)¥9,0 (~1,26 $)¥27,0 (~3,78 $)Нет
DeepSeek V4-Pro (вне пика)¥4,5 (~0,63 $)¥13,5 (~1,89 $)Нет
Qwen3.8-Max (международный)2,00 $6,00 $Да (своя лицензия)
OpenAI GPT-5.6 Luna0,20 $1,20 $Нет
Claude Opus 5 (оценка по кратности Alibaba)~5,00 $~25,00 $Нет

Курс около ¥7,15 за доллар. Короткий ответ: нет. Внепиковый V4-Pro всё ещё заметно ниже Opus 5, но уже не самый дешёвый на столе. Международный Qwen и Luna обходят внепиковый тариф. Равенство «китайская = самая дешёвая» держалось в 2025 и начале 2026; это больше не безопасное допущение.

06

Спорное и неподтверждённое

  • Заголовок «1100%» технически верен, без контекста вводит в заблуждение. Он относится только к пиковому cache-hit входу. Выход вырос на 350%. СМИ цитируют разные строки как всю историю.
  • Утверждения, что Qwen3.8-Max крутится на чипах Zhenwu M890 Alibaba, есть в китайской финансовой прессе и не подтверждены техническими документами Alibaba или сторонними бенчмарками. Считать непроверенным.
  • GLM-5.3 якобы нашла серьёзную уязвимость Cursor: VentureBeat и Zhipu, без публичных технических деталей. Одностороннее раскрытие вендора.
  • Минкоммерции КНР якобы готовит ответные экспортные ограничения по ИИ и полупроводникам: спекуляция, официального подтверждения нет.
07

Почему это важно: две ценовые войны параллельно

В более широкой рамке виден узор. Примерно месяц китайские лидеры выпускают в темпе, который внутренняя финансовая пресса зовёт «три обновления в неделю» (一周三更) — DeepSeek, Alibaba, Zhipu, плюс Kimi K3 (16 июля, 2,8 трлн) и MiniMax H3. Китайские материалы жёстче англоязычных продуктовых заметок: «китайские открытые веса заставляют мир пересчитать цену ИИ».

Американские лаборатории играют наоборот на потребительском слое: OpenAI 30 июля срезала самый дешёвый ярус на 80% и через неделю сделала его бесплатным и безлимитным; Google 13 августа выпустила кодовую модель вдвое дешевле трёхнедельного предшественника. Китай открывает флагманы и ступенчато поднимает верх, США бегут к бесплатному и дешёвому внизу. Обе стратегии настоящие; они оптимизируют разные этажи воронки.

Есть и геополитический слой. Открытие Kimi K3 уже вызвало интерес США по безопасности; окно Alibaba для флагмана на 2,4 трлн часть аналитиков читает как закрепление международной паритетной истории до возможного ужесточения. Это интерпретация, не установленный факт — но контекст, который чисто англоязычные продуктовые новости часто пропускают.

Шесть шагов для покупателей API

  1. 01

    Привязать заголовок к строке: cache-hit вход, miss-вход или выход.

  2. 02

    Сдвинуть пакетные агент-задачи, оценки и регрессии с пекинских 9–12 и 14–18.

  3. 03

    Зафиксировать системные промпты и переиспользовать длинные префиксы, чтобы не платить miss + выход дважды.

  4. 04

    Прочитать лицензию Qwen3.8-Max: личное и внутреннее обычно свободно; MaaS/помощник свыше 50 млн долларов за 12 месяцев требует сделки.

  5. 05

    Не выбирать кодового агента по размеру базы — GLM-5.3 даёт почти 6x на том же основании.

  6. 06

    Прогнать тот же поток OpenClaw на отдельном удалённом Mac против DeepSeek вне пика, международного Qwen и GLM, затем зафиксировать умолчание после реальной недели счетов.

Цифры, которые можно цитировать

  • V4-Pro пиковый hit-вход: ¥0,025 → ¥0,30, около 1100%; выход: ¥6,0 → ¥27,0, 350%
  • Пик: Пекин 9–12 и 14–18; вне пика — половина
  • Тяжёлая нагрузка (~84 млн токенов/мес, в основном вне пика, половина попаданий): счёт около 1,8x
  • Qwen3.8-Max: 2,4 трлн / 95 млрд активных; международный API 2 / 6 $
  • Лицензия: MaaS/помощник свыше 50 млн $ за 12 месяцев; 100 млн MAU или 20 млн $/мес выручки должны показывать имя
  • GLM-5.3 Terminal-Bench 3.0: 4,6% → 28,3% на той же базе 743 млрд; позади Sol 34,6% и Fable 5 33,7%
08

Частые вопросы

Вне пика он всё ещё дешевле Claude Opus 5, но уже не самый дешёвый вариант в целом. GPT-5.6 Luna (0,20/1,20 $ за миллион токенов) и международный Qwen3.8-Max (2/6 $) обходят новый внепиковый тариф DeepSeek хотя бы по одной оси. Для frontier-класса DeepSeek всё ещё относительно дёшев, просто больше не однозначно самый дешёвый.

В большинстве случаев да: личные проекты и внутренняя эксплуатация не затронуты. Исключение — Model-as-a-Service или ИИ-помощник с выручкой свыше 50 млн долларов за 12 месяцев; тогда нужна отдельная коммерческая лицензия Alibaba.

Нет. В опубликованном тексте нет географических ограничений. Барьеры привязаны к выручке, а не к месту.

На уровне базы — ничем: оба на 743 млрд параметров. Прирост (примерно 6x на Terminal-Bench 3.0) целиком из масштабированного RL в пост-обучении, без нового предобучения.

Пока нет. Glimmer — дистиллят на 30 млрд. Цукерберг анонсировал открытые веса Muse Spark 1.2; это намерение, а не состоявшийся релиз.

Заключение

Как только почасовой тариф жив, ноутбук или долгоживущий офисный Mac показывают две дыры: пик плохо сдвигается, три счёта не садятся рядом в одной графической сессии агента. Гнаться за заголовком 1100% или читать открытые веса как свободную коммерческую лицензию превращает скрытую стоимость в счёт следующего месяца. Маршрутизацию DeepSeek / Qwen / GLM, префиксы кэша и внепиковые задачи лучше вынести на удалённый Mac, который можно выключить после опыта. Арендуйте удалённый Mac VNCMac, прогоните OpenClaw вне пика и в пик, затем зафиксируйте умолчание. Начните с тарифов Mac; как вычислительный счёт переходит в цену — в заметке о втором раунде DeepSeek.

Источники: официальное объявление тарифов DeepSeek, сверка с Wall Street CN, IT Home, AIGC.cn и V2EX; официальные репозитории Qwen Alibaba (Hugging Face / ModelScope) и SCMP по лицензии; техническая страница GLM-5.3 Zhipu (Z.ai), VentureBeat и StableLearn; блог Meta AI Research и VentureBeat о Muse Glimmer; Yicai и Sohu Finance о ритме китайских open-weight релизов. Цены, лицензии и бенчмарки — публичные данные на дату публикации. Перед перепечаткой сверяйте актуальные официальные тексты; чипы, уязвимость Cursor и слухи об экспорте остаются неподтверждёнными.