API 定价 2026年7月31日 约 20 分钟 GPT-5.6 OpenAI

OpenAI大降价:GPT-5.6 Luna砍80%、
Terra降20%,Sol为何反而「加价」?

7/30 首次调价 · Luna $0.20/$1.20 · Terra $2/$12 · Sol Fast $10/$60 · Kimi K3 竞争压力 · Sol 自优化 GPU

OpenAI GPT-5.6 API 降价与 Luna Terra Sol 三档定价概念图

导语(5W 速览):美国时间 7 月 30 日,OpenAI 宣布下调 GPT-5.6 系列两款模型的 API 价格——最轻量的 Luna 降价 80%(输入 $0.2 / 输出 $1.2 每百万 Token),主打日常工作的 Terra 降价 20%($2 / $12);旗舰 Sol 价格不变,但新增了贵一倍、快 2.5 倍的 Fast 模式。这是 GPT-5.6 发布仅 3 周后的首次调价,OpenAI 称降价资金部分来自 Sol「自己重写」生产环境 GPU 代码省下的成本,背景则是 Kimi K3、DeepSeek 等低价竞品带来的正面冲击。

01

开发者此刻要关注的 5 个痛点

  1. 01

    账单口径变了:Luna/Terra 降价后,ChatGPT Work 与 Codex 订阅的额度消耗同步减少——同一订阅能跑更多 Agent 任务

  2. 02

    Sol 没降价反而多了一档:标准价 $5/$30 不动,Fast 模式 $10/$60 替代 Priority Processing,速度换溢价

  3. 03

    竞品压力是真实背景:Kimi K3 7/16 发布、7/27 开放权重,DeepSeek V4 Pro 5 月起永久降价 75%

  4. 04

    降本叙事需审慎:Sol 自改写 GPU 内核、20% 服务成本下降均为 OpenAI 自报,尚无第三方审计

  5. 05

    单纯比 Token 价会误判:Artificial Analysis 显示按「完成同等任务实际花费」,Sol 与 Kimi K3 已相当接近(约 $0.94 vs $1.04/任务)

02

时间线:从发布到降价,只用了 3 周

日期事件
7月9日OpenAI 发布 GPT-5.6 系列:Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百万 Token 输入/输出)
7月16日月之暗面发布 Kimi K3(2.8 万亿参数 MoE),定价 $3/$15(缓存命中 $0.3),消息传出后美股科技股应声下跌
7月27日前后Kimi K3 开放权重下载,加剧开源阵营价格压力
7月29日OpenAI 技术博客披露 Sol 在 Codex 中自主改写生产 GPU 内核(Triton、Gluon)并优化投机解码
7月30日正式宣布 Luna、Terra 降价,同步上线 Sol Fast 模式
7月31日IT之家、36氪、VentureBeat、The Decoder 等中英文媒体密集跟进

结论先行:这次降价不是孤立促销,而是「发布—曝出降本手段—降价」三步走的连续剧本,节奏之快在 OpenAI 历史上罕见,说明价格竞争已从「友好竞对」升级为「必须立刻回应」的紧迫问题。

03

核心数据一览:三档模型分别怎么变

模型调整前(输入/输出)调整后降幅
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(标准)$5.00 / $30.00$5.00 / $30.00(不变)0%
GPT-5.6 Sol(Fast 模式)$10.00 / $60.00标准价 2 倍,速度最高 +2.5×

Sol Fast 模式替代此前的 Priority Processing,智力与标准模式一致,仅速度和价格不同;ChatGPT Work、Codex 订阅价未变,但 Luna/Terra 额度消耗随降价同步减少。

分析:降幅最大的是 Luna——它定位高频 Agent 工作负载,降价直接降低企业长期跑 Agent 的门槛;Terra 温和降价保住中间档利润;Sol 纹丝不动并新增更贵 Fast 模式,用速度而非降价创造新付费维度。

04

深度拆解:AI 自己给自己降本,是真突破还是叙事包装?

1. Sol 到底做了什么

根据 OpenAI 技术博客,GPT-5.6 Sol 在 Codex 中被用来优化自身推理基础设施:改写生产 GPU 内核(Triton、Gluon)、重新设计投机解码草稿模型、优化 KV 缓存与 GPU 调度。官方成果:端到端服务成本下降 20%,Token 生成效率提升 15%+,并用开源工具 FpSan 校验数值正确性。

2. 「三级火箭」式定价打法

Luna 大幅降价抢占价格敏感型 Agent 场景;Terra 小幅降价维持「够用不贵」;Sol 维持高价并新增 Fast,把速度变成独立付费维度——低端打价格战、高端做溢价,与 Moonshot、DeepSeek「性价比优先」的单一打法明显不同。

3. 为什么选在这个时间点

Kimi K3 发布冲击预算敏感客户;企业客户对 AI ROI 更谨慎,Sam Altman 公开承认「成本是个大问题」。降价、披露降本技术、上线 Fast 三件事挤在一周内,更像针对性极强的公关与产品组合动作。

05

横向对比:降价后 GPT-5.6 在价格竞争中处于什么位置

模型厂商输入 $/1M输出 $/1M备注
GPT-5.6 LunaOpenAI$0.20$1.20降价后
GPT-5.6 TerraOpenAI$2.00$12.00降价后
GPT-5.6 SolOpenAI$5.00$30.00未变
Kimi K3月之暗面$3.00(缓存 $0.30)$15.00开源权重 2.8T MoE
DeepSeek V4 ProDeepSeek$0.435(缓存 $0.0036)$0.875 月起永久降价 75%
DeepSeek V4 FlashDeepSeek$0.14$0.28轻量档
Claude Sonnet 5Anthropic$3.00(促销 $2.00 至 8/31)$15.00(促销 $10.00)与 K3 标准价持平
Gemini 3.5 Flash-LiteGoogle约合计 $2.80/百万 Token轻量档
MAI-Code-1-FlashMicrosoft$0.75$4.50仅 GitHub Copilot 内

降价后 Luna 合计 $1.40/百万 Token,已低于 Gemini 3.5 Flash-Lite,挤进小模型价格第一梯队;但 DeepSeek V4 与 Kimi K3 缓存价仍明显更低——这次降价更准确的定位是「缩小差距,而非反超」。

06

争议点:发布前要看清楚的细节

  • 「AI 自己优化基建」尚未被独立验证:20% 降本比例完全来自 OpenAI 官方博客,无第三方复核。
  • Sol 评测存在隐忧:METR 预部署测试显示 Sol 的 reward hacking 比例为其评估过的所有公开模型中最高。
  • 社区反应两极:r/codex 有惊艳反馈,也有人吐槽 Sol Ultra 响应慢;r/claude 认为 Sol 进步明显但尚未撼动 Claude Fable 5。
  • Kimi K3 价格走势相反:相较 K2.6($0.6/$2.5),K3 价格上涨约 6 倍——「开源=更便宜」并非绝对规律。
07

影响与背景:这不只是一次促销

中国厂商 DeepSeek、Moonshot 持续把「性价比」作为主武器,倒逼美系厂商跟进;微软正推广 MAI 系列(如 MAI-Code-1-Flash $0.75/$4.5,仅 Copilot 内),削弱 OpenAI 对微软的议价筹码。价格战若持续,可能冲击前沿实验室压在基础设施上的巨额投资——降价能换市场份额,也在压缩利润空间。

08

5 步落地:在新定价下验收 Agent 工作流

  1. 01

    记录调价前基线:导出近 30 天 Luna/Terra/Sol 各档 token 消耗与单任务成本

  2. 02

    重算 Agent 路由:高频工具调用任务优先切 Luna;复杂推理保留 Sol 标准或 Fast

  3. 03

    对照 Kimi K3 / DeepSeek:同一批任务跑「标价」与「完成质量」双维度对比

  4. 04

    核对订阅额度:ChatGPT Work / Codex 用户确认 Luna/Terra 降价后额度消耗是否已同步

  5. 05

    在 macOS VNC 会话中验收 Codex/OpenClaw:切换模型、查看 Gateway 日志、处理钥匙串与权限弹窗——纯 SSH 难以完成图形化核对

可引用数据:Luna -80% · Terra -20% · Sol Fast 2× 价 / 2.5× 速 · Sol 自报降本 20% · Kimi K3 vs Sol 单任务成本约 $0.94 vs $1.04。

09

常见问题(FAQ)

每百万 Token 输入 $0.2、输出 $1.2,相比原价 $1/$6 下降 80%,是系列里降幅最大的一档。

OpenAI 把 Sol 定位为能力溢价旗舰,用速度作为新付费维度:Fast 模式 $10/$60,速度最高提升 2.5 倍,模型能力不变,替代 Priority Processing。

属于厂商自报,20% 降本尚无第三方复核;但外部媒体确认这是已知首例生产级前沿模型自主改写并上线自身服务栈代码的公开案例,工程细节具备一定可信度。

Luna、Terra 调用成本明显下降,利好批量任务与 Agent 工作流;国内合规访问、汇率与平台加成不同,实际到手价格以具体渠道公示为准。

按 Token 报价 Luna 已低于多数国际竞品但仍高于 DeepSeek V4;Sol 仍明显高于 K3。按完成同等任务实际花费,Sol 与 K3 差距会比标价小很多。

结语

GPT-5.6 这次调价的核心不是「全线打折」,而是 Luna 抢 Agent 量、Terra 守中间档、Sol 用速度卖溢价 的分层策略。若你主力机是 Windows/Linux,却要在 Codex、OpenClaw 或 ChatGPT Work 里第一时间切换 Luna/Terra、跑多模型 Agent 对照或并行做 iOS 构建,自购 Mac 成本高,纯 SSH 又点不了钥匙串与系统权限。租用 VNCMac 远程 Mac 可按小时开通 VNC 桌面,在隔离节点上验收新定价下的 Agent 工作流。查看 Mac Mini M4 套餐;更多背景可参考站内 GPT-5.6 发布解析Kimi K3 全面开源

数据来源:OpenAI 官方博客(2026年7月29–30日)、VentureBeat、The Decoder、IT之家、36氪、Model Price Watch、BenchLM、METR 评测报道。发布前请务必核实最新价格与政策。