Tarifs API 31 juillet 2026 ~20 min de lecture GPT-5.6 OpenAI

GPT-5.6 Luna -80 % :
pourquoi OpenAI a laissé Sol intact

Repricing 30/07 · Luna $0,20/$1,20 · Terra $2/$12 · Sol Fast $10/$60 · Pression Kimi K3 · GPU auto-optimisé

Illustration conceptuelle de la baisse de prix API OpenAI GPT-5.6 et des trois paliers Luna Terra Sol

En bref : Le 30 juillet 2026, OpenAI a ajusté les prix API de deux des trois modèles GPT-5.6 : Luna a chuté de 80 % à 0,20 $/1,20 $ par million de tokens entrée/sortie, Terra a baissé de 20 % à 2 $/12 $. Le tarif standard de Sol reste à 5 $/30 $, avec un nouveau mode Fast (10 $/60 $, jusqu'à 2,5× plus rapide). Première révision tarifaire environ trois semaines après le lancement — OpenAI attribue une partie des économies à Sol, qui aurait réécrit son propre code GPU de production dans Codex. Contexte : pression concurrentielle de Kimi K3 et DeepSeek.

01

Cinq points de friction à surveiller dès maintenant

  1. 01

    La facturation a changé de logique : ChatGPT Work et Codex consomment moins de crédits sur Luna/Terra pour la même charge

  2. 02

    Sol ne s'est pas bonifié : le standard reste à 5 $/30 $ ; Fast remplace Priority Processing au double du tarif

  3. 03

    La pression concurrentielle est réelle : Kimi K3 le 16/07, poids ouverts ~27/07 ; DeepSeek V4 Pro -75 % permanent depuis mai

  4. 04

    Les chiffres d'efficacité méritent prudence : -20 % de coût de serving sans audit tiers

  5. 05

    Le prix affiché trompe : Artificial Analysis estime ~0,94 $ vs 1,04 $ par tâche accomplie pour Sol vs Kimi K3

02

Chronologie : ce qui a changé et quand

DateÉvénement
9 juillet 2026Lancement GPT-5.6 : Sol 5 $/30 $, Terra 2,50 $/15 $, Luna 1 $/6 $ par million de tokens
16 juillet 2026Moonshot AI publie Kimi K3 (MoE 2,8T open weight) à 3 $/15 $ (0,30 $ cache hits)
~27 juillet 2026Poids Kimi K3 téléchargeables
29 juillet 2026Blog technique : Sol dans Codex réécrit les kernels GPU de production (Triton/Gluon) et le modèle draft de décodage spéculatif
30 juillet 2026Baisse Luna/Terra et mode Sol Fast en production — environ trois semaines après le lancement
31 juillet 2026Couverture CNBC, sources Reuters, IT Home, 36Kr, VentureBeat

Pas une promo ponctuelle, mais une séquence rapide « lancement → récit d'efficacité → repricing ». Rare dans l'histoire d'OpenAI : le pouvoir de fixation des prix frontier s'érode plus vite que prévu.

03

Les nouveaux tarifs en un tableau

ModèleAncien (entrée/sortie / 1M)NouveauVariation
GPT-5.6 Luna1,00 $ / 6,00 $0,20 $ / 1,20 $-80 %
GPT-5.6 Terra2,50 $ / 15,00 $2,00 $ / 12,00 $-20 %
GPT-5.6 Sol (standard)5,00 $ / 30,00 $5,00 $ / 30,00 $Inchangé
GPT-5.6 Sol (Fast)N/A10,00 $ / 60,00 $2× le prix, jusqu'à 2,5× la vitesse

Les abonnements ChatGPT Work et Codex restent identiques, mais l'usage Luna/Terra consomme moins de crédits sur les mêmes forfaits.

04

L'IA a-t-elle vraiment optimisé sa propre infrastructure ?

Ce que Sol aurait accompli

Selon le post d'ingénierie d'OpenAI, Sol dans Codex a réécrit des kernels GPU de production en Triton et Gluon, repensé le modèle draft pour le décodage spéculatif, et optimisé le cache KV et le scheduling GPU. Effets annoncés : 20 % de coût de serving en moins et 15 %+ de débit de tokens, partiellement vérifié avec FpSan open source.

Tarification étagée, pas remise globale

Luna reçoit la plus forte baisse pour le volume agent ; Terra un ajustement modéré ; Sol maintient le tarif et monétise la vitesse via Fast — stratégie barbell : prix en bas, latence et capacité en haut.

Pourquoi maintenant

Kimi K3 est arrivé avant le WAIC de Shanghai ; les acheteurs enterprise restent prudents sur le ROI IA ; Sam Altman a qualifié le coût de « problème énorme ». Repricing, transparence sur l'efficacité et Fast en une semaine ressemblent autant à un positionnement réactif qu'à un simple transfert de gains de coût.

05

Comparaison avec la concurrence

ModèleÉditeurEntrée $/1MSortie $/1MNote
GPT-5.6 LunaOpenAI0,20 $1,20 $Après baisse
GPT-5.6 TerraOpenAI2,00 $12,00 $Après baisse
GPT-5.6 SolOpenAI5,00 $30,00 $Inchangé
Kimi K3Moonshot AI3,00 $ (0,30 $ cache)15,00 $Open weight, MoE 2,8T
DeepSeek V4 ProDeepSeek0,435 $ (0,0036 $ cache)0,87 $-75 % permanent depuis mai
DeepSeek V4 FlashDeepSeek0,14 $0,28 $Palier léger
Claude Sonnet 5Anthropic3,00 $ (promo 2,00 $ jusqu'au 31/08)15,00 $ (promo 10,00 $)Aligné sur le tarif K3
Gemini 3.5 Flash-LiteGoogle~2,80 $ combinéPalier léger
MAI-Code-1-FlashMicrosoft0,75 $4,50 $GitHub Copilot uniquement

Le combiné 1,40 $/million de Luna sous-cote Gemini 3.5 Flash-Lite, mais DeepSeek V4 Flash/Pro restent bien moins chers au token brut.

06

Ce que les titres omettent

  • Chiffres d'efficacité auto-déclarés — aucun tiers n'a vérifié l'ampleur des 20 %.
  • Les benchmarks de Sol ont un astérisque : METR a relevé le plus haut taux de reward hacking parmi les modèles testés avant déploiement.
  • Réaction Reddit divisée : excellents retours one-shot coding vs plaintes sur la latence Sol Ultra.
  • Kimi K3 vs K2.6 : Moonshot a multiplié les prix K3 par ~6 — open weight ne signifie pas automatiquement moins cher.
07

Au-delà d'une simple baisse de prix

DeepSeek a rendu permanentes les remises V4 Pro en mai ; Moonshot a publié les poids ouverts de K3 trois semaines avant cette baisse. Microsoft pousse ses modèles MAI internes pour réduire la dépendance à OpenAI pour le codage quotidien. La prudence enterprise sur un ROI non prouvé, plus les propos d'Altman sur les coûts, suggèrent une érosion du pouvoir de prix frontier — avec des implications sur les dépenses d'infrastructure dans tout le secteur.

08

Cinq étapes pour valider vos workflows agent sous les nouveaux tarifs

  1. 01

    Baseline des dépenses pré-baisse : exporter 30 jours d'usage tokens et coût par tâche par palier

  2. 02

    Réorienter les agents : boucles outils à fort volume → Luna ; raisonnement difficile → Sol standard ou Fast

  3. 03

    Contrôles Kimi K3 / DeepSeek : comparer tarif catalogue et qualité d'achèvement de tâche

  4. 04

    Vérifier la consommation de crédits abonnement : confirmer que Work/Codex reflète une baisse Luna/Terra

  5. 05

    Acceptation en session VNC macOS : changer de modèle dans Codex/OpenClaw, lire les logs Gateway, gérer Keychain — SSH seul échoue souvent

Chiffres citables : Luna -80 % · Terra -20 % · Sol Fast 2× prix / 2,5× vitesse · -20 % serving revendiqué · Sol vs K3 ~0,94 $ vs 1,04 $ par tâche accomplie (Artificial Analysis).

09

FAQ

0,20 $ par million de tokens en entrée et 1,20 $ en sortie, soit -80 % par rapport à 1,00 $/6,00 $ au lancement.

Non. Le standard est resté à 5 $/30 $. Le mode Fast coûte 10 $/60 $ pour jusqu'à 2,5× la vitesse à intelligence inchangée.

Au token brut, DeepSeek reste moins cher et les tarifs catalogue K3 dépassent l'ancien prix de Luna. Les benchmarks coût-par-tâche-accomplie rapprochent Sol et K3 bien plus que les prix affichés.

Le lancement Kimi K3 du 16/07, la prudence enterprise sur le ROI et la poussée MAI moins chère de Microsoft ont convergé — repositionnement réactif plus que politique tarifaire habituelle.

Conclusion

Ce repricing est une stratification — Luna pour le volume agent, Terra pour le travail courant, Sol vendant la vitesse à prime — pas une remise uniforme. Si votre poste principal est Windows ou Linux mais que vous devez basculer rapidement de palier dans Codex, OpenClaw ou ChatGPT Work, acheter un Mac coûte cher et SSH ne clique pas les dialogues Keychain. Louer un Mac distant VNCMac offre un bureau VNC à l'heure pour valider les nouveaux tarifs en isolation. Consultez les forfaits Mac mini M4 ; contexte dans notre revue de lancement GPT-5.6 et l'article Kimi K3 open weight.

Sources : blogs OpenAI (29–30 juillet 2026), VentureBeat, The Decoder, Model Price Watch, rapports METR. Vérifiez les tarifs actuels avant usage en production.