7/30 재가격 · Luna $0.20/$1.20 · Terra $2/$12 · Sol Fast $10/$60 · Kimi K3 압박 · Sol 자체 GPU 최적화
핵심 요약: 2026년 7월 30일 OpenAI는 GPT-5.6 3종 중 2종의 API 가격을 조정했습니다. 경량 Luna는 80% 인하되어 입력 $0.20·출력 $1.20(백만 토큰당), 일상용 Terra는 20% 인하되어 $2/$12입니다. 플래그십 Sol 표준 요금은 $5/$30 그대로이며, Fast 모드($10/$60·최대 2.5배 속도)가 신설되었습니다. 출시 약 3주 만의 첫 인하이며, OpenAI는 일부 절감분이 Sol이 프로덕션 GPU 커널을 스스로 재작성한 데서 비롯됐다고 설명합니다. 배경에는 Kimi K3와 DeepSeek의 가격 공세가 있습니다.
과금 기준이 바뀌었다: Luna/Terra 인하로 ChatGPT Work·Codex 구독 크레딧 소모가 줄어 같은 플랜으로 더 많은 Agent 작업이 가능합니다
Sol은 싸지지 않았다: 표준 $5/$30 유지. Fast는 Priority Processing을 대체하는 속도 프리미엄으로 요금이 2배입니다
경쟁 압력은 실재한다: Kimi K3는 7/16 출시, 7/27경 오픈 웨이트 공개. DeepSeek V4 Pro는 5월부터 75% 인하를 영구화했습니다
효율 수치는 자체 보고: 서빙 비용 20% 절감에 제3자 감사가 없어 마케팅과 엔지니어링 경계가 모호합니다
단가만 보면 오판한다: Artificial Analysis 기준 작업 완료당 실비용은 Sol 약 $0.94, Kimi K3 약 $1.04로 표면 단가 차이보다 접근합니다
| 날짜 | 사건 |
|---|---|
| 2026년 7월 9일 | GPT-5.6 출시: Sol $5/$30, Terra $2.50/$15, Luna $1/$6 (백만 토큰당) |
| 2026년 7월 16일 | Moonshot AI Kimi K3(2.8T MoE·오픈 웨이트) $3/$15 출시 (캐시 히트 $0.30) |
| 7월 말 (~27일) | Kimi K3 웨이트 다운로드 가능 |
| 2026년 7월 29일 | 엔지니어링 블로그: Codex 내 Sol이 프로덕션 GPU 커널(Triton/Gluon)과 추측 디코딩 드래프트 모델 재설계 |
| 2026년 7월 30일 | Luna/Terra 인하 및 Sol Fast 모드 프로덕션 배포——출시 약 3주 후 |
| 2026년 7월 31일 | CNBC, Reuters 계열, IT Home, 36Kr, VentureBeat 등 보도 확산 |
일회성 프로모션이 아니라 「출시 → 효율 스토리 공개 → 재가격」의 짧은 시퀀스입니다. OpenAI 역사에서도 드물게, 프론티어 모델의 가격 결정력이 예상보다 빨리 침식되고 있음을 시사합니다.
| 모델 | 기존 (입/출·100만) | 신규 | 변화 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol (표준) | $5.00 / $30.00 | $5.00 / $30.00 | 변경 없음 |
| GPT-5.6 Sol (Fast) | 없음 | $10.00 / $60.00 | 2배 요금·최대 2.5배 속도 |
ChatGPT Work와 Codex 월정액은 그대로이나, Luna/Terra 호출의 실질 비용은 내려가 동일 구독으로 더 많은 Agent 워크로드를 소화할 수 있습니다.
OpenAI 엔지니어링 글에 따르면 Codex의 Sol이 프로덕션 GPU 커널을 Triton·Gluon으로 재작성하고, 추측 디코딩용 드래프트 모델을 재설계하며 KV 캐시·GPU 스케줄링을 조정했습니다. 공표 효과는 엔드투엔드 서빙 비용 20% 절감, 토큰 처리량 15% 이상 향상이며, 일부는 오픈소스 FpSan으로 검증했다고 합니다.
Luna에 최대 인하를 적용해 고볼륨 Agent 시장을 선점하고, Terra는 중간층을 유지하며, Sol은 능력과 지연시간으로 프리미엄을 받는 바벨 전략입니다. 하단은 가격, 상단은 속도로 수익을 나눕니다.
Kimi K3는 상하이 WAIC 전후에 투입됐고, 기업의 AI ROI 신중론도 이어집니다. Sam Altman은 비용을 「거대한 이슈」라 했으며, 재가격·효율 공개·Fast 모드가 한 주에 몰린 것은 순수 비용 환원보다 경쟁 대응 성격이 강합니다.
| 모델 | 제공사 | 입력 $/100만 | 출력 $/100만 | 비고 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 인하 후 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 인하 후 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 유지 |
| Kimi K3 | Moonshot AI | $3.00 (캐시 $0.30) | $15.00 | 오픈 웨이트·2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435 (캐시 $0.0036) | $0.87 | 5월부터 75% 영구 인하 |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 경량 티어 |
| Claude Sonnet 5 | Anthropic | $3.00 (8/31까지 $2.00) | $15.00 (프로모 $10.00) | K3 정가와 동일 |
| Gemini 3.5 Flash-Lite | 합산 약 $2.80 | 경량 티어 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | GitHub Copilot 전용 |
Luna 입출력 합산 $1.40/백만은 Gemini 3.5 Flash-Lite보다 낮지만, DeepSeek V4 Flash/Pro는 여전히 토큰 단가에서 훨씬 저렴합니다.
DeepSeek는 5월 V4 Pro 인하를 영구화했고, Moonshot은 이번 조정 3주 전 K3 오픈 웨이트를 공개했습니다. Microsoft는 사내 MAI 모델로 일상 코딩에서의 OpenAI 의존을 줄이고 있습니다. 기업의 미검증 ROI 신중론과 Altman의 비용 발언을 합치면, 프론티어 가격 프리미엄이 침식 단계에 들어갔으며 추론 인프라 투자 재배치를 촉발합니다.
인하 전 지출 베이스라인: 최근 30일 토큰 사용량·티어별 작업당 비용을 추출합니다
Agent 라우팅 재구성: 고빈도 툴 루프는 Luna, 난이도 높은 추론은 Sol 표준 또는 Fast로
Kimi K3 / DeepSeek 대조군: 정가와 작업 완료 품질을 함께 비교합니다
구독 크레딧 소모 재확인: Work/Codex에서 Luna/Terra 실크레딧이 줄었는지 검증합니다
macOS VNC 세션에서 인수 테스트: Codex/OpenClaw 모델 전환, Gateway 로그, Keychain 대화상자——SSH만으로는 막히기 쉽습니다
인용 가능 수치: Luna -80% · Terra -20% · Sol Fast 2배 요금/2.5배 속도 · 공표 서빙 20% 절감 · Sol vs K3 작업 완료 약 $0.94 vs $1.04 (Artificial Analysis).
입력 $0.20/백만 토큰, 출력 $1.20/백만 토큰입니다. 출시가 $1.00/$6.00 대비 80% 인하입니다.
표준 $5/$30은 유지됩니다. Fast 모드는 $10/$60이며, 모델 능력은 동일한 채 최대 2.5배 빠른 응답을 제공합니다.
토큰 단가로는 DeepSeek가 가장 저렴하고, Kimi K3 정가는 Luna 구가보다 높습니다. 작업 완료 비용 벤치마크에서는 Sol과 K3가 표면 차이보다 가깝습니다.
Kimi K3 7/16 출시, 기업 ROI 신중론, Microsoft 저가 MAI 추진이 겹친 결과로, 반응적 가격 조정 성격이 강합니다.
이번 조정은 Luna로 Agent 물량, Terra로 중간층, Sol로 속도 프리미엄을 받는 계층 전략이지 전면 할인이 아닙니다. Windows/Linux가 주력이어도 Codex, OpenClaw, ChatGPT Work에서 티어 전환·Agent 벤치마크가 급하면 Mac 구매는 부담이고 SSH만으로는 Keychain·권한 대화상자를 처리할 수 없습니다. VNCMac 원격 Mac으로 시간 과금 VNC 데스크톱에서 신가격을 격리 검증하세요. Mac mini M4 플랜을 확인하고, 배경은 GPT-5.6 출시 가이드와 Kimi K3 오픈 웨이트 해설을 참고하세요.
출처: OpenAI 공식 블로그(2026년 7월 29–30일), VentureBeat, The Decoder, Model Price Watch, METR 보도. 프로덕션 전 최신 가격을 반드시 확인하세요.