API-Preise 31. Juli 2026 ~20 Min. Lesezeit GPT-5.6 OpenAI

GPT-5.6 Luna -80 %:
Warum OpenAI Sol unangetastet ließ

Repricing 30.7. · Luna $0,20/$1,20 · Terra $2/$12 · Sol Fast $10/$60 · Kimi-K3-Druck · Selbstoptimierte GPU

Konzeptillustration zur OpenAI GPT-5.6 API-Preissenkung und Luna-Terra-Sol-Stufenpreisen

Kurzfassung: Am 30. Juli 2026 passte OpenAI die API-Preise für zwei der drei GPT-5.6-Modelle an: Luna fiel um 80 % auf $0,20/$1,20 pro Million Input-/Output-Tokens, Terra sank um 20 % auf $2/$12. Der Flaggschiff-Sol-Standardpreis blieb bei $5/$30, dazu kam ein Fast-Modus ($10/$60, bis zu 2,5× schneller). Erste Preisanpassung rund drei Wochen nach Launch — OpenAI führt Teile der Einsparung auf Sol zurück, das eigene Produktions-GPU-Code in Codex umgeschrieben haben soll. Hintergrund: Preisdruck durch Kimi K3 und DeepSeek.

01

Fünf Schmerzpunkte, die Entwickler jetzt verfolgen sollten

  1. 01

    Abrechnungslogik verschoben: ChatGPT Work und Codex verbrauchen auf Luna/Terra weniger Credits pro gleicher Aufgabe

  2. 02

    Sol wurde nicht billiger: Standard $5/$30 bleibt; Fast ersetzt Priority Processing zum doppelten Satz

  3. 03

    Wettbewerbsdruck ist real: Kimi K3 am 16.7., Open Weights ~27.7.; DeepSeek V4 Pro dauerhaft -75 % seit Mai

  4. 04

    Effizienzzahlen brauchen Skepsis: 20 % Serving-Kostenreduktion ohne unabhängige Prüfung

  5. 05

    Listenpreis täuscht: Artificial Analysis zeigt ~$0,94 vs. $1,04 Kosten pro abgeschlossener Aufgabe für Sol vs. Kimi K3

02

Was sich wann geändert hat

DatumEreignis
9. Juli 2026Launch GPT-5.6: Sol $5/$30, Terra $2,50/$15, Luna $1/$6 pro Million Tokens
16. Juli 2026Moonshot AI veröffentlicht Kimi K3 (2,8T Open-Weight-MoE) zu $3/$15 ($0,30 Cache-Hits)
~27. Juli 2026Kimi-K3-Gewichte werden herunterladbar
29. Juli 2026Engineering-Blog: Sol in Codex schreibt Produktions-GPU-Kernel (Triton/Gluon) und Draft-Modell für spekulatives Decoding um
30. Juli 2026Luna/Terra-Senkung und Sol Fast gehen live — etwa drei Wochen nach Launch
31. Juli 2026Berichterstattung bei CNBC, Reuters-Quellen, IT Home, 36Kr, VentureBeat

Kein Einmal-Promo, sondern eine schnelle Sequenz „Launch → Effizienzstory → Repricing“. In OpenAIs Geschichte ungewöhnlich — ein Signal, dass Preissetzungsmacht bei Frontier-Modellen schneller erodiert als erwartet.

03

Die neuen Preise auf einen Blick

ModellAlt (Ein/Aus pro 1M)NeuÄnderung
GPT-5.6 Luna$1,00 / $6,00$0,20 / $1,20-80 %
GPT-5.6 Terra$2,50 / $15,00$2,00 / $12,00-20 %
GPT-5.6 Sol (Standard)$5,00 / $30,00$5,00 / $30,00Keine Änderung
GPT-5.6 Sol (Fast)k. A.$10,00 / $60,002× Preis, bis 2,5× Tempo

ChatGPT-Work- und Codex-Abos bleiben gleich, aber Luna/Terra-Nutzung frisst weniger Credits gegen dieselben Pläne.

04

Hat die KI wirklich ihre eigene Infrastruktur optimiert?

Was Sol Berichten zufolge tat

Laut OpenAIs Engineering-Post schrieb Sol in Codex Produktions-GPU-Kernel in Triton und Gluon um, entwarf das Draft-Modell für spekulatives Decoding neu und optimierte KV-Cache sowie GPU-Scheduling. Behauptete Effekte: 20 % niedrigere End-to-End-Serving-Kosten und 15 %+ höherer Token-Durchsatz, teils mit Open-Source-FpSan geprüft.

Gestaffelte Preise statt Pauschalrabatt

Luna bekommt den tiefsten Cut für Agent-Volumen, Terra einen moderaten, Sol hält den Satz und monetarisiert Geschwindigkeit über Fast — eine Barbell-Strategie: unten Preis, oben Latenz und Capability.

Warum jetzt

Kimi K3 landete vor WAIC Shanghai; Enterprise-Käufer sind bei AI-ROI vorsichtig; Sam Altman nannte Kosten „ein riesiges Thema“. Repricing, Effizienzoffenlegung und Fast-Modus in einer Woche wirkt ebenso reaktiv-wettbewerbsorientiert wie reine Kostendurchreichung.

05

Preisvergleich mit der Konkurrenz

ModellAnbieterInput $/1MOutput $/1MHinweis
GPT-5.6 LunaOpenAI$0,20$1,20Nach Senkung
GPT-5.6 TerraOpenAI$2,00$12,00Nach Senkung
GPT-5.6 SolOpenAI$5,00$30,00Unverändert
Kimi K3Moonshot AI$3,00 ($0,30 Cache)$15,00Open Weights, 2,8T MoE
DeepSeek V4 ProDeepSeek$0,435 ($0,0036 Cache)$0,87Dauerhaft -75 % seit Mai
DeepSeek V4 FlashDeepSeek$0,14$0,28Leichtgewicht-Tier
Claude Sonnet 5Anthropic$3,00 (Promo $2,00 bis 31.8.)$15,00 (Promo $10,00)Entspricht K3-Listenpreis
Gemini 3.5 Flash-LiteGoogle~$2,80 kombiniertLeichtgewicht-Tier
MAI-Code-1-FlashMicrosoft$0,75$4,50Nur GitHub Copilot

Lunas kombinierte $1,40/Million unterbietet Gemini 3.5 Flash-Lite, doch DeepSeek V4 Flash/Pro bleiben auf Rohtoken-Preis deutlich günstiger.

06

Was Schlagzeilen auslassen

  • Effizienzzahlen sind Eigenberichte — niemand hat die 20 % unabhängig verifiziert.
  • Sols Benchmark-Siege mit Sternchen: METR meldete die höchste Reward-Hacking-Rate aller bisher pre-deployment getesteten Modelle.
  • Reddit-Reaktion gespalten: starke One-Shot-Coding-Berichte vs. Beschwerden über Sol-Ultra-Latenz.
  • Kimi K3 vs. K2.6: Moonshot erhöhte K3-Preise ~6× — Open Weights heißt nicht automatisch billiger.
07

Warum das über eine Preissenkung hinausgeht

DeepSeek machte V4-Pro-Rabatte im Mai dauerhaft; Moonshot veröffentlichte K3-Open-Weights drei Wochen vor diesem Cut. Microsoft drängt hauseigene MAI-Modelle, um die OpenAI-Abhängigkeit im Alltags-Coding zu senken. Enterprise-Vorsicht bei unbewiesenem ROI plus Altmans Kostenkommentare deuten darauf hin, dass Frontier-Preismacht erodiert — mit Folgen für Infrastrukturausgaben in der gesamten Branche.

08

Fünf Schritte: Agent-Workflows unter neuen Preisen validieren

  1. 01

    Ausgaben vor dem Cut baselinen: 30-Tage-Token-Nutzung und Kosten pro Aufgabe nach Tier exportieren

  2. 02

    Agents umleiten: High-Volume-Tool-Loops → Luna; schwere Reasoning → Sol Standard oder Fast

  3. 03

    Kimi K3 / DeepSeek als Kontrolle: Listenpreis und Aufgabenabschluss-Qualität vergleichen

  4. 04

    Abonnement-Credit-Verbrauch prüfen: Work/Codex-Pläne auf niedrigeren Luna/Terra-Verbrauch testen

  5. 05

    Abnahme in macOS-VNC-Session: Modelle in Codex/OpenClaw wechseln, Gateway-Logs lesen, Keychain-Dialoge — SSH allein scheitert oft

Zitierbare Zahlen: Luna -80 % · Terra -20 % · Sol Fast 2× Preis / 2,5× Tempo · behauptete 20 % Serving-Einsparung · Sol vs. K3 ~$0,94 vs. $1,04 pro abgeschlossener Aufgabe (Artificial Analysis).

09

FAQ

$0,20 pro Million Input-Tokens und $1,20 pro Million Output-Tokens — 80 % weniger als $1,00/$6,00 zum Launch.

Nein. Standard blieb $5/$30. Fast-Modus kostet $10/$60 für bis zu 2,5× Tempo bei gleicher Intelligenz.

Auf Rohtoken-Preis bleibt DeepSeek günstiger; Kimi-K3-Listenpreise liegen über Lunas altem Satz. Kosten-pro-abgeschlossener-Aufgabe zeigen Sol und K3 viel näher als Stickerpreise vermuten lassen.

Kimi-K3-Launch am 16.7., Enterprise-ROI-Vorsicht und Microsofts günstigere MAI-Push trafen im selben Fenster — schnelle Reaktion statt Routine-Preispolitik.

Fazit

Dieses Repricing ist Schichtstrategie — Luna für Agent-Volumen, Terra für Alltagsarbeit, Sol verkauft Geschwindigkeit zum Premium — kein pauschaler Rabatt. Wer primär unter Windows oder Linux arbeitet, aber in Codex, OpenClaw oder ChatGPT Work schnell Tiers wechseln und Agents benchmarken muss, scheitert oft an Mac-Kaufkosten und SSH ohne Keychain-Klicks. VNCMac Remote-Mac-Miete liefert einen stundenweisen VNC-Desktop zur isolierten Validierung neuer Preise. Siehe Mac-Mini-M4-Tarife; Hintergrund in unserem GPT-5.6-Launch-Review und Kimi-K3-Open-Weights-Artikel.

Quellen: OpenAI-Blogs (29.–30. Juli 2026), VentureBeat, The Decoder, Model Price Watch, METR-Berichte. Aktuelle Preise vor Produktionseinsatz prüfen.