Réponse X de Musk à @rauchg · Roadmap 1,5T / 2,1T · SFT & RL · Pression Kimi K3 · affirmations non vérifiées signalées
En bref : Elon Musk annonce Grok 4.6 « autour du 7 août », suivi d'un Grok 4.7 plus grand quelques semaines plus tard. Il a partagé la chronologie le 28 juillet 2026 en réponse au PDG de Vercel Guillermo Rauch sur X — pas dans une annonce officielle xAI. Aucun benchmark, tarif ni fiche modèle. Cet article distingue ce qui est documenté des affirmations éditeur et des fuites sectorielles — les détails non vérifiés sont clairement signalés.
Risque de source unique : la seule source primaire est une réponse X — pas de billet xAI, fiche modèle ni page tarifs
Le « Musk time » : chez xAI, Tesla et SpaceX, les calendriers glissent historiquement de jours à semaines
Fenêtres d'évaluation compressées : Kimi K3 est désormais full open-weight ; Claude Fable 5.1 pointe aussi vers août selon les rumeurs
Benchmarks et tarifs absents : contrairement à Grok 4.5, 4.6/4.7 n'ont aucune vérification tierce
Controverses sécurité persistantes : le procès CSAM de xAI en juillet et les notes child-safety comptent pour le risque entreprise, indépendamment de la puissance brute
| Date | Événement |
|---|---|
| 8 juillet 2026 | xAI livre Grok 4.5 — focus coding/agentique, co-entraînement Cursor. Contexte 500K, 2 $/6 $ par million tokens in/out, fiche modèle avec 15 scores benchmark |
| 16–26 juillet 2026 | Kimi K3 de Moonshot AI passe de preview hébergée à open-weight complet (2,8T, 1M contexte), en tête du trending Hugging Face ; Musk l'a salué dans des fils benchmark |
| 28 juillet 2026 | Musk publie la roadmap Grok 4.6/4.7 en réponse à Rauch. Le même jour, 1 200+ employés d'OpenAI, Anthropic, Google DeepMind et Meta signent la lettre « Pacing the Frontier » |
| ~7 août 2026 (cible) | Grok 4.6, 1,5T paramètres, positionné comme upgrade SFT/RL plutôt que simple montée en échelle |
| Fin août–début sept. 2026 (est.) | Grok 4.7, 2,1T paramètres — Musk : « meilleur que 4.6 à tous égards, sauf légèrement plus lent à servir, avec une efficacité token encore supérieure » |
| Modèle | Date | Paramètres | Focus | Statut |
|---|---|---|---|---|
| Grok 4.3 Beta | 17 avr. 2026 | Non divulgué | Baseline | Livré |
| Grok 4.5 | 8 juil. 2026 | Non divulgué (SKU unique) | Coding/agentique, co-entraînement Cursor | Livré, benchmarké |
| Grok 4.6 | ~7 août 2026 | 1,5T | Upgrade SFT/RL | Annoncé par tweet, non livré |
| Grok 4.7 | ~fin août–début sept. | 2,1T | Upgrade large, meilleure efficacité token | Annoncé par tweet, non livré |
Tous les chiffres Grok 4.6/4.7 proviennent d'affirmations éditeur non vérifiées dans un seul post social — à traiter comme indicatifs, pas comme specs confirmées.
Le supervised fine-tuning (SFT) façonne le comportement sur des exemples curatés ; le reinforcement learning (RL) apprend quelles séquences d'actions fonctionnent dans de vraies tâches agentiques multi-étapes. La formulation de Musk « significantly improved SFT & RL » indique que xAI double la mise sur le playbook Grok 4.5 : environ 15 954 tokens de sortie par tâche SWE-Bench Pro contre 67 020 pour Opus 4.8 — un écart d'efficacité 4,2× attribué au post-entraînement sur de vraies sessions développeur Cursor, pas à la taille brute du modèle.
Le saut de Grok 4.6 à 1,5T est une vraie montée en échelle, mais le cadrage de Musk sur 4.7 comme plus grand (2,1T) et « meilleur partout sauf légèrement plus lent » suggère deux SKU avec des compromis latence/qualité différents — comme le split Sonnet/Opus d'Anthropic ou les tiers mini/full d'OpenAI.
Le contexte concurrentiel : la cible Grok 4.6 tombe ~10 jours après le choc open-weight de Kimi K3. K3 a dominé Frontend Code Arena avec 1 679 points — premier modèle open-weight à battre tous les modèles fermés sur ce tableau — et se classe troisième sur l'Intelligence Index d'Artificial Analysis. Les médias financiers chinois ont relayé d'importantes variations de sentiment sur la capitalisation ; ce sont des estimations d'analystes via la presse, non confirmées indépendamment par les entreprises concernées.
| Modèle | Éditeur | Paramètres | Contexte | Tarif (in/out par 1M) | Source |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | Non divulgué | 500K | 2 $ / 6 $ | xAI officiel |
| Grok 4.6 (annoncé) | xAI | 1,5T | Non divulgué | Non divulgué | Post X de Musk (non vérifié) |
| Kimi K3 | Moonshot AI | 2,8T MoE (~16/896 actifs) | 1M | 0,30 $ cache / 3 $ miss in, 15 $ out | Moonshot + Hugging Face |
| Claude Fable 5.1 (rumeur) | Anthropic | Non divulgué | Non divulgué | Rumeur Fable 5 (10 $/50 $) | 36kr, WinCentral — non confirmé |
| GPT-5.6 Sol | OpenAI | Non divulgué | Non divulgué | Non divulgué | OpenAI officiel |
Si la chronologie de Musk tient, Grok 4.6 et 4.7 arrivent le même mois que le Claude Fable 5.1 supposé (fuites 36kr et WinCentral, calés pour devancer un GPT-6 anticipé) et quelques semaines après le choc open-weight de Kimi K3. Pour les équipes qui évaluent des modèles, la durée de vie utile de chaque flagship se compresse à quelques semaines — l'efficacité token et le coût réel par tâche, plus que le rang leaderboard seul, deviennent la base de choix la plus durable.
Geler votre baseline Grok 4.5 : journaliser types de tâches, usage tokens et coût par tâche dans Cursor/API pour comparer à périmètre constant
Surveiller les canaux xAI officiels : x.ai/news et @xai — pas seulement les réponses X
Suivre Kimi K3 et les rumeurs Fable 5.1 en parallèle : août pourrait être une course à trois — classer vos scénarios (coding, agents, long contexte, coût)
Préparer un environnement de test isolé : volatilité API, quotas et changements tarifaires en semaine 1 sont fréquents
Valider l'intégration Cursor en session GUI macOS : Grok 4.5 a été co-entraîné avec Cursor ; 4.6 y arrivera probablement en premier — changement de modèle et dialogues Keychain exigent un vrai bureau Mac, pas le SSH seul
Chiffres citables : Grok 4.5 à 2 $/6 $ par M tokens · cible 4.6 1,5T · cible 4.7 2,1T · Kimi K3 Frontend Code Arena 1 679 · Grok 4.5 ~15 954 vs Opus 4.8 ~67 020 tokens de sortie par tâche SWE-Bench Pro.
Musk a indiqué « autour du 7 août 2026 » dans un post X, mais xAI n'a pas confirmé officiellement la date. Traitez-la comme un objectif susceptible de glisser.
Grok 4.6 fait 1,5T avec focus post-entraînement SFT/RL. Grok 4.7, quelques semaines plus tard, fait 2,1T — Musk dit qu'il bat 4.6 partout sauf en vitesse de service, échangeant latence contre meilleure efficacité token.
Trop tôt. Grok 4.6 n'a aucun benchmark publié ; Kimi K3 a des scores vérifiés ; Claude Fable 5.1 n'est pas confirmé officiellement par Anthropic.
Inconnu. Grok 4.5 a été lancé à 2 $/6 $ par million tokens in/out — référence raisonnable, mais xAI n'a pas communiqué de tarifs 4.6.
Attendez-vous à Grok Build, l'API xAI et la console en premier, puis des plateformes tierces comme Cursor — d'après le déploiement Grok 4.5, non confirmé pour 4.6.
Grok 4.6 reste une roadmap dans un tweet, pas une fiche modèle — mais avec le choc open-weight de Kimi K3 et l'embouteillage d'août, construire une baseline de comparaison maintenant vaut mieux que courir après les gros titres de paramètres. Si votre poste principal est Windows ou Linux mais que vous devez changer de modèle Grok dans Cursor, lancer des benchmarks agent ou paralléliser des builds iOS, acheter un Mac coûte cher et le SSH seul ne clique pas les dialogues Keychain ou permissions système. Louer un Mac distant VNCMac vous donne un bureau VNC horaire pour valider Grok et les workflows multi-modèles OpenClaw en isolation. Voir les forfaits location Mac ; contexte dans notre avis Grok 4.5 et le guide Kimi K3 open-weight.
Sources : xAI « Introducing Grok 4.5 » et fiche modèle (media.x.ai), post X de Musk du 28 juillet 2026 (réponse à @rauchg), Chain Tech Daily / Tron Weekly, releases Moonshot AI, Emergent.sh / WinCentral / 36kr sur les fuites Fable 5.1, The Verge / TechTimes sur « Pacing the Frontier », Ars Technica / TechCrunch sur les controverses sécurité xAI. Informations au 30 juillet 2026 — tous les détails Grok 4.6/4.7 sont des annonces éditeur ou fuites sectorielles ; vérifiez les canaux xAI officiels avant de vous fier à une date, spec ou tarif.