Переоценка 30.07 · Luna $0,20/$1,20 · Terra $2/$12 · Sol Fast $10/$60 · Давление Kimi K3 · Самооптимизация GPU
Кратко: 30 июля 2026 OpenAI скорректировала API-цены для двух из трёх моделей GPT-5.6: Luna подешевела на 80% до $0,20/$1,20 за миллион входных/выходных токенов, Terra — на 20% до $2/$12. Стандартный тариф Sol остался $5/$30, зато появился режим Fast ($10/$60, до 2,5× быстрее). Первое пересмотрение цен примерно через три недели после запуска — OpenAI объясняет часть экономии тем, что Sol в Codex переписал собственный продакшн GPU-код. На фоне — ценовое давление Kimi K3 и DeepSeek.
Изменилась логика биллинга: ChatGPT Work и Codex тратят меньше кредитов на нагрузки Luna/Terra при тех же задачах
Sol не подешевела: стандарт $5/$30 сохранён; Fast заменяет Priority Processing по удвоенному тарифу
Конкурентное давление реально: Kimi K3 — 16.07, открытые веса ~27.07; DeepSeek V4 Pro с мая с постоянным −75%
Цифры эффективности требуют скепсиса: −20% стоимости serving без независимого аудита
Номинальная цена обманчива: Artificial Analysis оценивает ~$0,94 vs $1,04 за завершённую задачу для Sol vs Kimi K3
| Дата | Событие |
|---|---|
| 9 июля 2026 | Запуск GPT-5.6: Sol $5/$30, Terra $2,50/$15, Luna $1/$6 за миллион токенов |
| 16 июля 2026 | Moonshot AI выпускает Kimi K3 (2,8T MoE с открытыми весами) по $3/$15 ($0,30 cache hits) |
| ~27 июля 2026 | Веса Kimi K3 становятся доступны для скачивания |
| 29 июля 2026 | Инженерный блог: Sol в Codex переписывает продакшн GPU-ядра (Triton/Gluon) и draft-модель спекулятивного декодирования |
| 30 июля 2026 | Снижение Luna/Terra и режим Sol Fast в продакшне — примерно через три недели после запуска |
| 31 июля 2026 | Освещение в CNBC, Reuters, IT Home, 36Kr, VentureBeat |
Это не разовая акция, а быстрая цепочка «запуск → история об эффективности → переоценка». Для OpenAI необычно — сигнал, что ценовая власть frontier-моделей эродирует быстрее ожиданий.
| Модель | Было (вх/вых за 1M) | Стало | Изменение |
|---|---|---|---|
| GPT-5.6 Luna | $1,00 / $6,00 | $0,20 / $1,20 | −80% |
| GPT-5.6 Terra | $2,50 / $15,00 | $2,00 / $12,00 | −20% |
| GPT-5.6 Sol (стандарт) | $5,00 / $30,00 | $5,00 / $30,00 | Без изменений |
| GPT-5.6 Sol (Fast) | н/д | $10,00 / $60,00 | 2× цена, до 2,5× скорости |
Подписки ChatGPT Work и Codex не изменились, но использование Luna/Terra потребляет меньше кредитов в рамках тех же планов.
По инженерному посту OpenAI, Sol в Codex переписал продакшн GPU-ядра на Triton и Gluon, перепроектировал draft-модель для спекулятивного декодирования, настроил KV-кэш и планирование GPU. Заявленный эффект: 20% снижения end-to-end стоимости serving и 15%+ рост пропускной способности токенов, частично проверено с помощью open-source FpSan.
Luna получает максимальное снижение для объёмных agent-нагрузок, Terra — умеренную корректировку, Sol сохраняет тариф и монетизирует скорость через Fast — стратегия «штанги»: цена внизу, латентность и возможности вверху.
Kimi K3 вышел перед WAIC в Шанхае; корпоративные покупатели осторожны с ROI ИИ; Сэм Альтман называл стоимость «огромной проблемой». Переоценка, раскрытие эффективности и Fast за одну неделю выглядят столь же реактивно-конкурентно, сколь и как чистая передача сэкономленных затрат.
| Модель | Поставщик | Вход $/1M | Выход $/1M | Примечание |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0,20 | $1,20 | После снижения |
| GPT-5.6 Terra | OpenAI | $2,00 | $12,00 | После снижения |
| GPT-5.6 Sol | OpenAI | $5,00 | $30,00 | Без изменений |
| Kimi K3 | Moonshot AI | $3,00 ($0,30 cache) | $15,00 | Открытые веса, 2,8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0,435 ($0,0036 cache) | $0,87 | Постоянное −75% с мая |
| DeepSeek V4 Flash | DeepSeek | $0,14 | $0,28 | Лёгкий тариф |
| Claude Sonnet 5 | Anthropic | $3,00 (промо $2,00 до 31.08) | $15,00 (промо $10,00) | Совпадает с K3 |
| Gemini 3.5 Flash-Lite | ~$2,80 суммарно | Лёгкий тариф | ||
| MAI-Code-1-Flash | Microsoft | $0,75 | $4,50 | Только GitHub Copilot |
Суммарные $1,40/миллион у Luna ниже Gemini 3.5 Flash-Lite, но DeepSeek V4 Flash/Pro остаются значительно дешевле по сырой цене токена.
DeepSeek сделала скидки V4 Pro постоянными в мае; Moonshot опубликовала открытые веса K3 за три недели до этого снижения. Microsoft продвигает внутренние модели MAI, снижая зависимость от OpenAI в повседневном кодинге. Осторожность enterprise к непроверенному ROI плюс комментарии Альтмана о стоимости указывают на эрозию ценовой власти frontier — с последствиями для инфраструктурных расходов во всей отрасли.
Базовая линия расходов до снижения: экспортируйте 30-дневное потребление токенов и стоимость задачи по тарифам
Перенаправьте агентов: высокочастотные tool-циклы → Luna; сложное рассуждение → Sol стандарт или Fast
Контрольные Kimi K3 / DeepSeek: сравните прайс-лист и качество завершения задач
Проверьте расход кредитов подписки: убедитесь, что Work/Codex отражает снижение потребления Luna/Terra
Приёмка в macOS VNC-сессии: переключение моделей в Codex/OpenClaw, логи Gateway, диалоги Keychain — один SSH часто не справляется
Цитируемые цифры: Luna −80% · Terra −20% · Sol Fast 2× цена / 2,5× скорость · заявленная экономия serving 20% · Sol vs K3 ~$0,94 vs $1,04 за задачу (Artificial Analysis).
$0,20 за миллион входных токенов и $1,20 за миллион выходных — на 80% дешевле стартовых $1,00/$6,00.
Нет. Стандарт остался $5/$30. Fast стоит $10/$60 и даёт до 2,5× скорости при неизменной интеллектуальной мощности.
По сырой цене токена DeepSeek дешевле, а прайс-лист K3 выше старой цены Luna. Бенчмарки стоимости завершённой задачи показывают Sol и K3 гораздо ближе, чем кажется по номиналу.
Запуск Kimi K3 16.07, осторожность enterprise по ROI и продвижение более дешёвых MAI от Microsoft совпали в одном окне — реактивное позиционирование, а не рутинная ценовая политика.
Это переоценка — Luna для объёма агентов, Terra для повседневной работы, Sol продаёт скорость по премиуму — а не равномерная скидка. Если основная ОС — Windows или Linux, а в Codex, OpenClaw или ChatGPT Work нужно срочно переключать тарифы и бенчмаркать агентов, покупка Mac дорога, а SSH не кликает Keychain и диалоги разрешений. Аренда удалённого Mac VNCMac даёт почасовой VNC-рабочий стол для изолированной проверки новых цен. См. тарифы Mac mini M4; контекст — в обзоре запуска GPT-5.6 и статье об открытых весах Kimi K3.
Источники: блоги OpenAI (29–30 июля 2026), VentureBeat, The Decoder, Model Price Watch, отчёты METR. Проверяйте актуальные цены перед продакшн-использованием.