7/30 改定 · Luna $0.20/$1.20 · Terra $2/$12 · Sol Fast $10/$60 · Kimi K3 圧力 · Sol 自走 GPU 最適化
要点:2026年7月30日、OpenAIはGPT-5.6ファミリー3モデルのうち2つでAPI価格を改定しました。軽量版Lunaは80%引きで入力$0.20・出力$1.20(100万トークンあたり)、日常向けTerraは20%引きで$2/$12。旗艦Solの標準料金は据え置きのまま、Fastモード($10/$60・最大2.5倍速)が新設されました。公開から約3週間での初値下げであり、OpenAIは一部をSolが本番GPUカーネルを自ら書き換えたことによるコスト削減と説明しています。背景にはKimi K3やDeepSeekの価格攻勢があります。
課金の前提が変わった:Luna/Terraの安値化により、ChatGPT WorkやCodexのサブスク枠でも同じタスクのクレジット消費が減ります
Solは安くなっていない:標準$5/$30は維持。FastはPriority Processingに代わる速度課金で、料金は2倍です
競合圧力は現実的:Kimi K3は7/16リリース、7/27頃にオープンウェイト公開。DeepSeek V4 Proは5月から75%値下げを恒久化しています
効率化の数字は自社報告:推論コスト20%削減は第三者監査がなく、マーケティングとエンジニアリングの境界が曖昧です
単価だけ見ると誤算になる:Artificial Analysisではタスク完了あたりの実コストはSol約$0.94、Kimi K3約$1.04と、表向きの単価差より接近しています
| 日付 | 出来事 |
|---|---|
| 2026年7月9日 | GPT-5.6公開:Sol $5/$30、Terra $2.50/$15、Luna $1/$6(100万トークンあたり) |
| 2026年7月16日 | Moonshot AIがKimi K3(2.8T MoE・オープンウェイト)を$3/$15で投入(キャッシュヒット$0.30) |
| 7月下旬(〜27日) | Kimi K3のウェイトがダウンロード可能に |
| 2026年7月29日 | 技術ブログ:Codex内Solが本番GPUカーネル(Triton/Gluon)と投機デコード下書きモデルを再設計 |
| 2026年7月30日 | Luna/Terra値下げとSol Fastモードが本番投入——公開から約3週間 |
| 2026年7月31日 | CNBC、Reuters系、IT Home、36Kr、VentureBeatなど各社が報道 |
単発キャンペーンではなく、「公開 → 効率化ストーリー開示 → 再価格設定」という短期シーケンスです。OpenAI史上でも珍しく、フロンティアモデルの価格決定力が想定より早く侵食されているシグナルと読めます。
| モデル | 旧価格(入/出・100万) | 新価格 | 変化 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(標準) | $5.00 / $30.00 | $5.00 / $30.00 | 変更なし |
| GPT-5.6 Sol(Fast) | なし | $10.00 / $60.00 | 2倍料金・最大2.5倍速 |
ChatGPT WorkとCodexの月額は据え置きですが、Luna/Terra呼び出しの実質コストは下がり、同じサブスクでより多くのAgentワークロードを回せます。
OpenAIのエンジニアリング投稿によれば、Codex上のSolが本番GPUカーネルをTritonとGluonで書き直し、投機デコード用ドラフトモデルを再設計し、KVキャッシュとGPUスケジューリングを調整したとのことです。公称効果はエンドツーエンド推論コスト20%削減、トークンスループット15%以上向上。一部はオープンソースのFpSanで検証したとされています。
Lunaに最大の値引きを当てて高ボリュームAgent市場を取り、Terraは中間層を維持し、Solは能力とレイテンシでプレミアムを取る——いわゆるバーベル戦略です。安さで底を取り、上で速度を売る構図がはっきりしています。
Kimi K3は上海WAIC前後に投入され、企業のAI ROI慎重論も続いています。Sam Altmanはコストを「巨大な課題」と述べており、再価格設定・効率開示・Fastモードが1週間に集中したのは、純粋なコスト還元というより競合への反応的ポジショニングの色合いが強いと見られます。
| モデル | 提供元 | 入力 $/100万 | 出力 $/100万 | 備考 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 値下げ後 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 値下げ後 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 据え置き |
| Kimi K3 | Moonshot AI | $3.00(キャッシュ$0.30) | $15.00 | オープンウェイト・2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(キャッシュ$0.0036) | $0.87 | 5月から75%恒久値下げ |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 軽量ティア |
| Claude Sonnet 5 | Anthropic | $3.00(8/31まで$2.00) | $15.00(プロモ$10.00) | K3定価と同水準 |
| Gemini 3.5 Flash-Lite | 合算約$2.80 | 軽量ティア | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | GitHub Copilot限定 |
Lunaの入出力合算$1.40/百万はGemini 3.5 Flash-Liteを下回りますが、DeepSeek V4 Flash/Proは依然としてトークン単価で大幅に安い立場にあります。
DeepSeekは5月にV4 Proの値下げを恒久化し、Moonshotは今回の改定の3週間前にK3のオープンウェイトを公開しました。Microsoftは社内MAIモデルで日常コーディングからのOpenAI依存を減らす動きを加速しています。企業の未実証ROIへの慎重さとAltmanのコスト発言を合わせると、フロンティア価格のプレミアムは侵食段階に入っており、推論インフラ投資全体の再配分を迫る局面です。
改定前の支出をベースライン化:直近30日のトークン使用量とタスクあたりコストをティア別にエクスポートします
Agentのルーティングを組み替える:高頻度ツールループはLunaへ、難解な推論はSol標準またはFastへ
Kimi K3 / DeepSeekを対照群に:定価とタスク完了品質の両方を比較します
サブスク枠の消費を再確認:Work/CodexプランでLuna/Terraの実クレジット消費が下がっているか検証します
macOS VNCセッションで受け入れ試験:Codex/OpenClawでモデル切替、Gatewayログ確認、Keychainダイアログ対応——SSH単独では詰まりやすいです
引用可能な数値:Luna -80% · Terra -20% · Sol Fast 2倍料金/2.5倍速 · 公称推論コスト20%削減 · Sol vs K3 タスク完了約$0.94 vs $1.04(Artificial Analysis)。
入力$0.20/百万トークン、出力$1.20/百万トークンです。公開時の$1.00/$6.00から80%引きとなります。
標準料金$5/$30は据え置きです。Fastモードは$10/$60で、モデル能力は同じまま最大2.5倍の応答速度が得られます。
トークン単価ではDeepSeekが最も安く、Kimi K3の定価はLuna旧価格より上です。タスク完了コストのベンチマークではSolとK3は表向きの差より接近しています。
Kimi K3の7/16投入、企業ROIの慎重論、Microsoftの低価格MAI推進が重なった結果と見られ、反応的な価格調整の色合いが強いです。
今回の改定はLunaでAgent量を取り、Terraで中間層を守り、Solで速度にプレミアムを課すという階層戦略であり、全面値引きではありません。Windows/Linuxが主力でもCodex、OpenClaw、ChatGPT Workでティア切替やAgentベンチマークを急ぐなら、Mac購入は高コスト、SSHだけではKeychainや権限ダイアログを操作できません。VNCMacのリモートMacなら時間課金のVNCデスクトップで新価格を隔離検証できます。Mac mini M4 プランをご覧ください。背景はGPT-5.6 公開ガイドとKimi K3 オープンウェイト解説も参照してください。
出典:OpenAI公式ブログ(2026年7月29–30日)、VentureBeat、The Decoder、Model Price Watch、METR報道。本番利用前に最新価格を必ずご確認ください。