Цены API 31 июля 2026 ~20 мин чтения GPT-5.6 OpenAI

GPT-5.6 Luna −80%:
почему OpenAI не тронула Sol

Переоценка 30.07 · Luna $0,20/$1,20 · Terra $2/$12 · Sol Fast $10/$60 · Давление Kimi K3 · Самооптимизация GPU

Концептуальная иллюстрация снижения цен API OpenAI GPT-5.6 и трёхуровневого тарифа Luna Terra Sol

Кратко: 30 июля 2026 OpenAI скорректировала API-цены для двух из трёх моделей GPT-5.6: Luna подешевела на 80% до $0,20/$1,20 за миллион входных/выходных токенов, Terra — на 20% до $2/$12. Стандартный тариф Sol остался $5/$30, зато появился режим Fast ($10/$60, до 2,5× быстрее). Первое пересмотрение цен примерно через три недели после запуска — OpenAI объясняет часть экономии тем, что Sol в Codex переписал собственный продакшн GPU-код. На фоне — ценовое давление Kimi K3 и DeepSeek.

01

Пять болевых точек, которые стоит отслеживать сейчас

  1. 01

    Изменилась логика биллинга: ChatGPT Work и Codex тратят меньше кредитов на нагрузки Luna/Terra при тех же задачах

  2. 02

    Sol не подешевела: стандарт $5/$30 сохранён; Fast заменяет Priority Processing по удвоенному тарифу

  3. 03

    Конкурентное давление реально: Kimi K3 — 16.07, открытые веса ~27.07; DeepSeek V4 Pro с мая с постоянным −75%

  4. 04

    Цифры эффективности требуют скепсиса: −20% стоимости serving без независимого аудита

  5. 05

    Номинальная цена обманчива: Artificial Analysis оценивает ~$0,94 vs $1,04 за завершённую задачу для Sol vs Kimi K3

02

Что и когда изменилось

ДатаСобытие
9 июля 2026Запуск GPT-5.6: Sol $5/$30, Terra $2,50/$15, Luna $1/$6 за миллион токенов
16 июля 2026Moonshot AI выпускает Kimi K3 (2,8T MoE с открытыми весами) по $3/$15 ($0,30 cache hits)
~27 июля 2026Веса Kimi K3 становятся доступны для скачивания
29 июля 2026Инженерный блог: Sol в Codex переписывает продакшн GPU-ядра (Triton/Gluon) и draft-модель спекулятивного декодирования
30 июля 2026Снижение Luna/Terra и режим Sol Fast в продакшне — примерно через три недели после запуска
31 июля 2026Освещение в CNBC, Reuters, IT Home, 36Kr, VentureBeat

Это не разовая акция, а быстрая цепочка «запуск → история об эффективности → переоценка». Для OpenAI необычно — сигнал, что ценовая власть frontier-моделей эродирует быстрее ожиданий.

03

Новые цены в одной таблице

МодельБыло (вх/вых за 1M)СталоИзменение
GPT-5.6 Luna$1,00 / $6,00$0,20 / $1,20−80%
GPT-5.6 Terra$2,50 / $15,00$2,00 / $12,00−20%
GPT-5.6 Sol (стандарт)$5,00 / $30,00$5,00 / $30,00Без изменений
GPT-5.6 Sol (Fast)н/д$10,00 / $60,002× цена, до 2,5× скорости

Подписки ChatGPT Work и Codex не изменились, но использование Luna/Terra потребляет меньше кредитов в рамках тех же планов.

04

Правда ли, что ИИ оптимизировал собственную инфраструктуру?

Что, по отчётам, сделал Sol

По инженерному посту OpenAI, Sol в Codex переписал продакшн GPU-ядра на Triton и Gluon, перепроектировал draft-модель для спекулятивного декодирования, настроил KV-кэш и планирование GPU. Заявленный эффект: 20% снижения end-to-end стоимости serving и 15%+ рост пропускной способности токенов, частично проверено с помощью open-source FpSan.

Ступенчатое ценообразование, а не скидка на всё

Luna получает максимальное снижение для объёмных agent-нагрузок, Terra — умеренную корректировку, Sol сохраняет тариф и монетизирует скорость через Fast — стратегия «штанги»: цена внизу, латентность и возможности вверху.

Почему именно сейчас

Kimi K3 вышел перед WAIC в Шанхае; корпоративные покупатели осторожны с ROI ИИ; Сэм Альтман называл стоимость «огромной проблемой». Переоценка, раскрытие эффективности и Fast за одну неделю выглядят столь же реактивно-конкурентно, сколь и как чистая передача сэкономленных затрат.

05

Сравнение с конкурентами

МодельПоставщикВход $/1MВыход $/1MПримечание
GPT-5.6 LunaOpenAI$0,20$1,20После снижения
GPT-5.6 TerraOpenAI$2,00$12,00После снижения
GPT-5.6 SolOpenAI$5,00$30,00Без изменений
Kimi K3Moonshot AI$3,00 ($0,30 cache)$15,00Открытые веса, 2,8T MoE
DeepSeek V4 ProDeepSeek$0,435 ($0,0036 cache)$0,87Постоянное −75% с мая
DeepSeek V4 FlashDeepSeek$0,14$0,28Лёгкий тариф
Claude Sonnet 5Anthropic$3,00 (промо $2,00 до 31.08)$15,00 (промо $10,00)Совпадает с K3
Gemini 3.5 Flash-LiteGoogle~$2,80 суммарноЛёгкий тариф
MAI-Code-1-FlashMicrosoft$0,75$4,50Только GitHub Copilot

Суммарные $1,40/миллион у Luna ниже Gemini 3.5 Flash-Lite, но DeepSeek V4 Flash/Pro остаются значительно дешевле по сырой цене токена.

06

Что заголовки упускают

  • Цифры эффективности — самоотчёт — никто независимо не подтвердил масштаб 20%.
  • Бенчмарки Sol со звёздочкой: METR зафиксировал наивысший уровень reward hacking среди протестированных до деплоя моделей.
  • Реакция Reddit поляризована: сильные отзывы о one-shot кодинге vs жалобы на латентность Sol Ultra.
  • Kimi K3 vs K2.6: Moonshot поднял цены K3 примерно в 6 раз — открытые веса ≠ автоматически дешевле.
07

Почему это важнее одного снижения цен

DeepSeek сделала скидки V4 Pro постоянными в мае; Moonshot опубликовала открытые веса K3 за три недели до этого снижения. Microsoft продвигает внутренние модели MAI, снижая зависимость от OpenAI в повседневном кодинге. Осторожность enterprise к непроверенному ROI плюс комментарии Альтмана о стоимости указывают на эрозию ценовой власти frontier — с последствиями для инфраструктурных расходов во всей отрасли.

08

Пять шагов для проверки agent-воркфлоу по новым ценам

  1. 01

    Базовая линия расходов до снижения: экспортируйте 30-дневное потребление токенов и стоимость задачи по тарифам

  2. 02

    Перенаправьте агентов: высокочастотные tool-циклы → Luna; сложное рассуждение → Sol стандарт или Fast

  3. 03

    Контрольные Kimi K3 / DeepSeek: сравните прайс-лист и качество завершения задач

  4. 04

    Проверьте расход кредитов подписки: убедитесь, что Work/Codex отражает снижение потребления Luna/Terra

  5. 05

    Приёмка в macOS VNC-сессии: переключение моделей в Codex/OpenClaw, логи Gateway, диалоги Keychain — один SSH часто не справляется

Цитируемые цифры: Luna −80% · Terra −20% · Sol Fast 2× цена / 2,5× скорость · заявленная экономия serving 20% · Sol vs K3 ~$0,94 vs $1,04 за задачу (Artificial Analysis).

09

FAQ

$0,20 за миллион входных токенов и $1,20 за миллион выходных — на 80% дешевле стартовых $1,00/$6,00.

Нет. Стандарт остался $5/$30. Fast стоит $10/$60 и даёт до 2,5× скорости при неизменной интеллектуальной мощности.

По сырой цене токена DeepSeek дешевле, а прайс-лист K3 выше старой цены Luna. Бенчмарки стоимости завершённой задачи показывают Sol и K3 гораздо ближе, чем кажется по номиналу.

Запуск Kimi K3 16.07, осторожность enterprise по ROI и продвижение более дешёвых MAI от Microsoft совпали в одном окне — реактивное позиционирование, а не рутинная ценовая политика.

Заключение

Это переоценка — Luna для объёма агентов, Terra для повседневной работы, Sol продаёт скорость по премиуму — а не равномерная скидка. Если основная ОС — Windows или Linux, а в Codex, OpenClaw или ChatGPT Work нужно срочно переключать тарифы и бенчмаркать агентов, покупка Mac дорога, а SSH не кликает Keychain и диалоги разрешений. Аренда удалённого Mac VNCMac даёт почасовой VNC-рабочий стол для изолированной проверки новых цен. См. тарифы Mac mini M4; контекст — в обзоре запуска GPT-5.6 и статье об открытых весах Kimi K3.

Источники: блоги OpenAI (29–30 июля 2026), VentureBeat, The Decoder, Model Price Watch, отчёты METR. Проверяйте актуальные цены перед продакшн-использованием.