Musks X-Antwort an @rauchg · 1,5T / 2,1T Roadmap · SFT & RL · Kimi-K3-Druck · unbestätigte Angaben markiert
Kurzfassung: Elon Musk sagt, Grok 4.6 komme „rund 7. August“, mit einem größeren Grok 4.7 wenige Wochen später. Er teilte die Timeline am 28. Juli 2026 in einer Antwort an Vercel-CEO Guillermo Rauch auf X — nicht in einer offiziellen xAI-Ankündigung. Keine Benchmarks, Preise oder Model Card. Dieser Artikel trennt das, was belegt ist, von Herstellerangaben und Branchenleaks — unbestätigte Details sind klar markiert.
Single-Source-Risiko: Die einzige Primärquelle ist eine X-Antwort — kein xAI-Blogpost, keine Model Card, keine Preisseite
„Musk Time“: Bei xAI, Tesla und SpaceX verschieben sich Timelines historisch um Tage bis Wochen
Komprimierte Evaluierungsfenster: Kimi K3 ist vollständig open-weight; Gerüchte zu Claude Fable 5.1 zeigen ebenfalls auf August
Benchmarks und Preise fehlen: Anders als bei Grok 4.5 hat 4.6/4.7 null Drittpartei-Verifikation
Safety-Schlagzeilen bleiben: xAIs CSAM-Klage im Juli und Child-Safety-Ratings sind ein separates Enterprise-Risiko neben der Rohleistung
| Datum | Ereignis |
|---|---|
| 8. Juli 2026 | xAI liefert Grok 4.5 — Coding/Agenten-Fokus, Co-Training mit Cursor. 500K Kontext, 2 $/6 $ pro Mio. Input/Output, Model Card mit 15 Benchmark-Scores |
| 16.–26. Juli 2026 | Moonshot AIs Kimi K3 von gehosteter Preview zu vollständig open-weight (2,8T, 1M Kontext), toppt Hugging Face Trending; Musk lobte es in Benchmark-Threads |
| 28. Juli 2026 | Musk postet Grok-4.6/4.7-Roadmap als Antwort an Rauch. Am selben Tag veröffentlichen 1.200+ Mitarbeiter von OpenAI, Anthropic, Google DeepMind und Meta den „Pacing the Frontier“-Brief |
| ~7. August 2026 (Ziel) | Grok 4.6, 1,5T Parameter, positioniert als SFT/RL-Upgrade statt reiner Skalierung |
| Ende Aug.–Anfang Sep. 2026 (geschätzt) | Grok 4.7, 2,1T Parameter — Musk: „besser als 4.6 in jeder Hinsicht, außer etwas langsamer zu bedienen, dafür mit noch besserer Token-Effizienz“ |
| Modell | Datum | Parameter | Fokus | Status |
|---|---|---|---|---|
| Grok 4.3 Beta | 17. Apr. 2026 | Nicht veröffentlicht | Baseline | Ausgeliefert |
| Grok 4.5 | 8. Juli 2026 | Nicht veröffentlicht (ein SKU) | Coding/Agenten, Cursor Co-Training | Ausgeliefert, benchmarked |
| Grok 4.6 | ~7. Aug. 2026 | 1,5T | SFT/RL-Upgrade | Per Tweet angekündigt, nicht ausgeliefert |
| Grok 4.7 | ~Ende Aug.–Anfang Sep. | 2,1T | Breites Upgrade, bessere Token-Effizienz | Per Tweet angekündigt, nicht ausgeliefert |
Alle Grok-4.6/4.7-Angaben sind unbestätigte Herstellerclaims aus einem Social-Media-Post — als Richtwerte, nicht als bestätigte Specs behandeln.
Supervised Fine-Tuning (SFT) formt Verhalten an kuratierten Beispielen; Reinforcement Learning (RL) lehrt, welche Aktionssequenzen in echten mehrstufigen Agentenaufgaben funktionieren. Musks Formulierung „significantly improved SFT & RL“ signalisiert: xAI verdoppelt das Grok-4.5-Playbook — rund 15.954 Output-Tokens pro SWE-Bench-Pro-Aufgabe gegenüber 67.020 bei Opus 4.8, eine 4,2×-Effizienzlücke durch Post-Training auf echten Cursor-Entwicklersessions, nicht durch reine Modellgröße.
Grok 4.6s Sprung auf 1,5T ist eine echte Skalierung, aber Musks Framing von 4.7 als größer (2,1T) und dennoch „besser in jeder Hinsicht außer etwas langsamer“ deutet auf zwei SKUs mit unterschiedlichen Latenz/Qualitäts-Trade-offs hin — ähnlich Anthropics Sonnet/Opus-Split oder OpenAIs Mini/Full-Tiers.
Der Wettbewerbsrahmen: Grok 4.6s Ziel liegt ~10 Tage nach Kimi K3s Open-Weight-Schock. K3 toppte Frontend Code Arena mit 1.679 Punkten — erstes Open-Weight-Modell, das jedes Closed Model auf dem Board schlägt — und rangiert dritt auf dem Artificial-Analysis-Intelligence-Index. Chinesische Finanzmedien berichteten über massive Marktkapitalisierungs-Sentiment-Schwankungen; das sind Analystenschätzungen über Medien, nicht unabhängig von den beteiligten Unternehmen bestätigt.
| Modell | Anbieter | Parameter | Kontext | Preis (In/Out pro 1M) | Quelle |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | Nicht veröffentlicht | 500K | 2 $ / 6 $ | xAI offiziell |
| Grok 4.6 (angekündigt) | xAI | 1,5T | Nicht veröffentlicht | Nicht veröffentlicht | Musks X-Post (unbestätigt) |
| Kimi K3 | Moonshot AI | 2,8T MoE (~16/896 aktiv) | 1M | 0,30 $ Cache / 3 $ Miss In, 15 $ Out | Moonshot + Hugging Face |
| Claude Fable 5.1 (Gerücht) | Anthropic | Nicht veröffentlicht | Nicht veröffentlicht | Gerücht Fable 5 (10 $/50 $) | 36kr, WinCentral — unbestätigt |
| GPT-5.6 Sol | OpenAI | Nicht veröffentlicht | Nicht veröffentlicht | Nicht veröffentlicht | OpenAI offiziell |
Hält Musks Timeline, landen Grok 4.6 und 4.7 im selben Monat wie das gemunkelte Claude Fable 5.1 (Leaks von 36kr und WinCentral, zeitlich vor erwartetem GPT-6) und wenige Wochen nach Kimi K3s Open-Weight-Schock. Für Teams, die Modelle evaluieren, schrumpft die Nutzungsdauer jedes Flaggschiffs auf Wochen — Token-Effizienz und reale Aufgabenkosten, nicht allein Leaderboard-Rang, werden zur dauerhafteren Entscheidungsgrundlage.
Grok-4.5-Baseline einfrieren: Aufgabentypen, Token-Verbrauch und Kosten pro Aufgabe in Cursor/API protokollieren für Vergleichbarkeit
Offizielle xAI-Kanäle beobachten: x.ai/news und @xai — nicht nur X-Antworten
Kimi K3 und Fable-5.1-Gerüchte parallel verfolgen: August könnte ein Drei-Wege-Rennen werden — Szenarien priorisieren (Coding, Agenten, Long Context, Kosten)
Isolierte Testumgebung bereitstellen: API-Volatilität, Quotas und Preisverschiebungen in Woche eins sind üblich
Cursor-Integration in macOS-GUI-Sitzung validieren: Grok 4.5 wurde mit Cursor co-trainiert; 4.6 landet vermutlich dort zuerst — Modellwechsel und Keychain-Dialoge brauchen echten Mac-Desktop, nicht nur SSH
Zitierbare Zahlen: Grok 4.5 bei 2 $/6 $ pro M Tokens · 4.6-Ziel 1,5T · 4.7-Ziel 2,1T · Kimi K3 Frontend Code Arena 1.679 · Grok 4.5 ~15.954 vs. Opus 4.8 ~67.020 Output-Tokens pro SWE-Bench-Pro-Aufgabe.
Musk nannte in einem X-Post „rund 7. August 2026“, xAI hat das Datum aber nicht offiziell bestätigt. Behandeln Sie es als Ziel, das sich verschieben kann.
Grok 4.6 hat 1,5T mit SFT/RL-Post-Training-Fokus. Grok 4.7, einige Wochen später, hat 2,1T — Musk sagt, es schlägt 4.6 überall außer Serving-Geschwindigkeit, tauscht Latenz gegen bessere Token-Effizienz.
Zu früh. Grok 4.6 hat keine veröffentlichten Benchmarks; Kimi K3 hat verifizierte Scores; Claude Fable 5.1 ist von Anthropic nicht offiziell bestätigt.
Unbekannt. Grok 4.5 startete bei 2 $/6 $ pro Mio. Input/Output — ein sinnvoller Referenzpunkt, aber xAI hat keine 4.6-Preise genannt.
Erwartet: Grok Build, xAI-API und Console zuerst, Drittplattformen wie Cursor kurz danach — basierend auf Grok 4.5, für 4.6 nicht bestätigt.
Grok 4.6 ist noch eine Roadmap in einem Tweet, keine Model Card — aber mit Kimi K3s Open-Weight-Schock und einem August-Stau lohnt sich jetzt eine Vergleichsbaseline mehr als Parameter-Schlagzeilen. Wenn Ihr Daily Driver Windows oder Linux ist, Sie aber Grok-Modelle in Cursor wechseln, Agent-Benchmarks fahren oder iOS-Builds parallel laufen lassen müssen: Hardware kaufen ist teuer, SSH-only klickt keine Keychain- oder Systemdialoge. Ein gemieteter VNCMac Remote-Mac gibt Ihnen einen stundenweisen VNC-Desktop zur Validierung von Grok- und OpenClaw-Multi-Modell-Workflows in Isolation. Siehe Mac-Mietpläne; Hintergrund in unserem Grok-4.5-Test und Kimi-K3-Open-Weight-Guide.
Quellen: xAI „Introducing Grok 4.5“ und Model Card (media.x.ai), Musks X-Post vom 28. Juli 2026 (Antwort an @rauchg), Chain Tech Daily / Tron Weekly, Moonshot-AI-Releases, Emergent.sh / WinCentral / 36kr zu Fable-5.1-Leaks, The Verge / TechTimes zu „Pacing the Frontier“, Ars Technica / TechCrunch zu xAI-Safety-Kontroversen. Stand 30. Juli 2026 — alle Grok-4.6/4.7-Details sind Herstellerankündigungen oder Branchenleaks; vor Verlass auf Datum, Spec oder Preis offizielle xAI-Kanäle prüfen.