Repricing 30.7. · Luna $0,20/$1,20 · Terra $2/$12 · Sol Fast $10/$60 · Kimi-K3-Druck · Selbstoptimierte GPU
Kurzfassung: Am 30. Juli 2026 passte OpenAI die API-Preise für zwei der drei GPT-5.6-Modelle an: Luna fiel um 80 % auf $0,20/$1,20 pro Million Input-/Output-Tokens, Terra sank um 20 % auf $2/$12. Der Flaggschiff-Sol-Standardpreis blieb bei $5/$30, dazu kam ein Fast-Modus ($10/$60, bis zu 2,5× schneller). Erste Preisanpassung rund drei Wochen nach Launch — OpenAI führt Teile der Einsparung auf Sol zurück, das eigene Produktions-GPU-Code in Codex umgeschrieben haben soll. Hintergrund: Preisdruck durch Kimi K3 und DeepSeek.
Abrechnungslogik verschoben: ChatGPT Work und Codex verbrauchen auf Luna/Terra weniger Credits pro gleicher Aufgabe
Sol wurde nicht billiger: Standard $5/$30 bleibt; Fast ersetzt Priority Processing zum doppelten Satz
Wettbewerbsdruck ist real: Kimi K3 am 16.7., Open Weights ~27.7.; DeepSeek V4 Pro dauerhaft -75 % seit Mai
Effizienzzahlen brauchen Skepsis: 20 % Serving-Kostenreduktion ohne unabhängige Prüfung
Listenpreis täuscht: Artificial Analysis zeigt ~$0,94 vs. $1,04 Kosten pro abgeschlossener Aufgabe für Sol vs. Kimi K3
| Datum | Ereignis |
|---|---|
| 9. Juli 2026 | Launch GPT-5.6: Sol $5/$30, Terra $2,50/$15, Luna $1/$6 pro Million Tokens |
| 16. Juli 2026 | Moonshot AI veröffentlicht Kimi K3 (2,8T Open-Weight-MoE) zu $3/$15 ($0,30 Cache-Hits) |
| ~27. Juli 2026 | Kimi-K3-Gewichte werden herunterladbar |
| 29. Juli 2026 | Engineering-Blog: Sol in Codex schreibt Produktions-GPU-Kernel (Triton/Gluon) und Draft-Modell für spekulatives Decoding um |
| 30. Juli 2026 | Luna/Terra-Senkung und Sol Fast gehen live — etwa drei Wochen nach Launch |
| 31. Juli 2026 | Berichterstattung bei CNBC, Reuters-Quellen, IT Home, 36Kr, VentureBeat |
Kein Einmal-Promo, sondern eine schnelle Sequenz „Launch → Effizienzstory → Repricing“. In OpenAIs Geschichte ungewöhnlich — ein Signal, dass Preissetzungsmacht bei Frontier-Modellen schneller erodiert als erwartet.
| Modell | Alt (Ein/Aus pro 1M) | Neu | Änderung |
|---|---|---|---|
| GPT-5.6 Luna | $1,00 / $6,00 | $0,20 / $1,20 | -80 % |
| GPT-5.6 Terra | $2,50 / $15,00 | $2,00 / $12,00 | -20 % |
| GPT-5.6 Sol (Standard) | $5,00 / $30,00 | $5,00 / $30,00 | Keine Änderung |
| GPT-5.6 Sol (Fast) | k. A. | $10,00 / $60,00 | 2× Preis, bis 2,5× Tempo |
ChatGPT-Work- und Codex-Abos bleiben gleich, aber Luna/Terra-Nutzung frisst weniger Credits gegen dieselben Pläne.
Laut OpenAIs Engineering-Post schrieb Sol in Codex Produktions-GPU-Kernel in Triton und Gluon um, entwarf das Draft-Modell für spekulatives Decoding neu und optimierte KV-Cache sowie GPU-Scheduling. Behauptete Effekte: 20 % niedrigere End-to-End-Serving-Kosten und 15 %+ höherer Token-Durchsatz, teils mit Open-Source-FpSan geprüft.
Luna bekommt den tiefsten Cut für Agent-Volumen, Terra einen moderaten, Sol hält den Satz und monetarisiert Geschwindigkeit über Fast — eine Barbell-Strategie: unten Preis, oben Latenz und Capability.
Kimi K3 landete vor WAIC Shanghai; Enterprise-Käufer sind bei AI-ROI vorsichtig; Sam Altman nannte Kosten „ein riesiges Thema“. Repricing, Effizienzoffenlegung und Fast-Modus in einer Woche wirkt ebenso reaktiv-wettbewerbsorientiert wie reine Kostendurchreichung.
| Modell | Anbieter | Input $/1M | Output $/1M | Hinweis |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0,20 | $1,20 | Nach Senkung |
| GPT-5.6 Terra | OpenAI | $2,00 | $12,00 | Nach Senkung |
| GPT-5.6 Sol | OpenAI | $5,00 | $30,00 | Unverändert |
| Kimi K3 | Moonshot AI | $3,00 ($0,30 Cache) | $15,00 | Open Weights, 2,8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0,435 ($0,0036 Cache) | $0,87 | Dauerhaft -75 % seit Mai |
| DeepSeek V4 Flash | DeepSeek | $0,14 | $0,28 | Leichtgewicht-Tier |
| Claude Sonnet 5 | Anthropic | $3,00 (Promo $2,00 bis 31.8.) | $15,00 (Promo $10,00) | Entspricht K3-Listenpreis |
| Gemini 3.5 Flash-Lite | ~$2,80 kombiniert | Leichtgewicht-Tier | ||
| MAI-Code-1-Flash | Microsoft | $0,75 | $4,50 | Nur GitHub Copilot |
Lunas kombinierte $1,40/Million unterbietet Gemini 3.5 Flash-Lite, doch DeepSeek V4 Flash/Pro bleiben auf Rohtoken-Preis deutlich günstiger.
DeepSeek machte V4-Pro-Rabatte im Mai dauerhaft; Moonshot veröffentlichte K3-Open-Weights drei Wochen vor diesem Cut. Microsoft drängt hauseigene MAI-Modelle, um die OpenAI-Abhängigkeit im Alltags-Coding zu senken. Enterprise-Vorsicht bei unbewiesenem ROI plus Altmans Kostenkommentare deuten darauf hin, dass Frontier-Preismacht erodiert — mit Folgen für Infrastrukturausgaben in der gesamten Branche.
Ausgaben vor dem Cut baselinen: 30-Tage-Token-Nutzung und Kosten pro Aufgabe nach Tier exportieren
Agents umleiten: High-Volume-Tool-Loops → Luna; schwere Reasoning → Sol Standard oder Fast
Kimi K3 / DeepSeek als Kontrolle: Listenpreis und Aufgabenabschluss-Qualität vergleichen
Abonnement-Credit-Verbrauch prüfen: Work/Codex-Pläne auf niedrigeren Luna/Terra-Verbrauch testen
Abnahme in macOS-VNC-Session: Modelle in Codex/OpenClaw wechseln, Gateway-Logs lesen, Keychain-Dialoge — SSH allein scheitert oft
Zitierbare Zahlen: Luna -80 % · Terra -20 % · Sol Fast 2× Preis / 2,5× Tempo · behauptete 20 % Serving-Einsparung · Sol vs. K3 ~$0,94 vs. $1,04 pro abgeschlossener Aufgabe (Artificial Analysis).
$0,20 pro Million Input-Tokens und $1,20 pro Million Output-Tokens — 80 % weniger als $1,00/$6,00 zum Launch.
Nein. Standard blieb $5/$30. Fast-Modus kostet $10/$60 für bis zu 2,5× Tempo bei gleicher Intelligenz.
Auf Rohtoken-Preis bleibt DeepSeek günstiger; Kimi-K3-Listenpreise liegen über Lunas altem Satz. Kosten-pro-abgeschlossener-Aufgabe zeigen Sol und K3 viel näher als Stickerpreise vermuten lassen.
Kimi-K3-Launch am 16.7., Enterprise-ROI-Vorsicht und Microsofts günstigere MAI-Push trafen im selben Fenster — schnelle Reaktion statt Routine-Preispolitik.
Dieses Repricing ist Schichtstrategie — Luna für Agent-Volumen, Terra für Alltagsarbeit, Sol verkauft Geschwindigkeit zum Premium — kein pauschaler Rabatt. Wer primär unter Windows oder Linux arbeitet, aber in Codex, OpenClaw oder ChatGPT Work schnell Tiers wechseln und Agents benchmarken muss, scheitert oft an Mac-Kaufkosten und SSH ohne Keychain-Klicks. VNCMac Remote-Mac-Miete liefert einen stundenweisen VNC-Desktop zur isolierten Validierung neuer Preise. Siehe Mac-Mini-M4-Tarife; Hintergrund in unserem GPT-5.6-Launch-Review und Kimi-K3-Open-Weights-Artikel.
Quellen: OpenAI-Blogs (29.–30. Juli 2026), VentureBeat, The Decoder, Model Price Watch, METR-Berichte. Aktuelle Preise vor Produktionseinsatz prüfen.