LLM-Release 30. Juli 2026 ~18 Min. Lesezeit Grok 4.6 xAI

Grok 4.6 Veröffentlichung:
Ist Musks 7.-August-Ziel realistisch?

Musks X-Antwort an @rauchg · 1,5T / 2,1T Roadmap · SFT & RL · Kimi-K3-Druck · unbestätigte Angaben markiert

Grok 4.6 xAI Large Language Model Release Vorschau

Kurzfassung: Elon Musk sagt, Grok 4.6 komme „rund 7. August“, mit einem größeren Grok 4.7 wenige Wochen später. Er teilte die Timeline am 28. Juli 2026 in einer Antwort an Vercel-CEO Guillermo Rauch auf X — nicht in einer offiziellen xAI-Ankündigung. Keine Benchmarks, Preise oder Model Card. Dieser Artikel trennt das, was belegt ist, von Herstellerangaben und Branchenleaks — unbestätigte Details sind klar markiert.

01

Warum Entwickler jetzt aufpassen sollten

  1. 01

    Single-Source-Risiko: Die einzige Primärquelle ist eine X-Antwort — kein xAI-Blogpost, keine Model Card, keine Preisseite

  2. 02

    „Musk Time“: Bei xAI, Tesla und SpaceX verschieben sich Timelines historisch um Tage bis Wochen

  3. 03

    Komprimierte Evaluierungsfenster: Kimi K3 ist vollständig open-weight; Gerüchte zu Claude Fable 5.1 zeigen ebenfalls auf August

  4. 04

    Benchmarks und Preise fehlen: Anders als bei Grok 4.5 hat 4.6/4.7 null Drittpartei-Verifikation

  5. 05

    Safety-Schlagzeilen bleiben: xAIs CSAM-Klage im Juli und Child-Safety-Ratings sind ein separates Enterprise-Risiko neben der Rohleistung

02

Was bestätigt ist vs. Musks Wort

DatumEreignis
8. Juli 2026xAI liefert Grok 4.5 — Coding/Agenten-Fokus, Co-Training mit Cursor. 500K Kontext, 2 $/6 $ pro Mio. Input/Output, Model Card mit 15 Benchmark-Scores
16.–26. Juli 2026Moonshot AIs Kimi K3 von gehosteter Preview zu vollständig open-weight (2,8T, 1M Kontext), toppt Hugging Face Trending; Musk lobte es in Benchmark-Threads
28. Juli 2026Musk postet Grok-4.6/4.7-Roadmap als Antwort an Rauch. Am selben Tag veröffentlichen 1.200+ Mitarbeiter von OpenAI, Anthropic, Google DeepMind und Meta den „Pacing the Frontier“-Brief
~7. August 2026 (Ziel)Grok 4.6, 1,5T Parameter, positioniert als SFT/RL-Upgrade statt reiner Skalierung
Ende Aug.–Anfang Sep. 2026 (geschätzt)Grok 4.7, 2,1T Parameter — Musk: „besser als 4.6 in jeder Hinsicht, außer etwas langsamer zu bedienen, dafür mit noch besserer Token-Effizienz“
03

Die Zahlen im Überblick

ModellDatumParameterFokusStatus
Grok 4.3 Beta17. Apr. 2026Nicht veröffentlichtBaselineAusgeliefert
Grok 4.58. Juli 2026Nicht veröffentlicht (ein SKU)Coding/Agenten, Cursor Co-TrainingAusgeliefert, benchmarked
Grok 4.6~7. Aug. 20261,5TSFT/RL-UpgradePer Tweet angekündigt, nicht ausgeliefert
Grok 4.7~Ende Aug.–Anfang Sep.2,1TBreites Upgrade, bessere Token-EffizienzPer Tweet angekündigt, nicht ausgeliefert

Alle Grok-4.6/4.7-Angaben sind unbestätigte Herstellerclaims aus einem Social-Media-Post — als Richtwerte, nicht als bestätigte Specs behandeln.

04

Warum xAI Post-Training betont, nicht nur Skalierung

Supervised Fine-Tuning (SFT) formt Verhalten an kuratierten Beispielen; Reinforcement Learning (RL) lehrt, welche Aktionssequenzen in echten mehrstufigen Agentenaufgaben funktionieren. Musks Formulierung „significantly improved SFT & RL“ signalisiert: xAI verdoppelt das Grok-4.5-Playbook — rund 15.954 Output-Tokens pro SWE-Bench-Pro-Aufgabe gegenüber 67.020 bei Opus 4.8, eine 4,2×-Effizienzlücke durch Post-Training auf echten Cursor-Entwicklersessions, nicht durch reine Modellgröße.

Grok 4.6s Sprung auf 1,5T ist eine echte Skalierung, aber Musks Framing von 4.7 als größer (2,1T) und dennoch „besser in jeder Hinsicht außer etwas langsamer“ deutet auf zwei SKUs mit unterschiedlichen Latenz/Qualitäts-Trade-offs hin — ähnlich Anthropics Sonnet/Opus-Split oder OpenAIs Mini/Full-Tiers.

Der Wettbewerbsrahmen: Grok 4.6s Ziel liegt ~10 Tage nach Kimi K3s Open-Weight-Schock. K3 toppte Frontend Code Arena mit 1.679 Punkten — erstes Open-Weight-Modell, das jedes Closed Model auf dem Board schlägt — und rangiert dritt auf dem Artificial-Analysis-Intelligence-Index. Chinesische Finanzmedien berichteten über massive Marktkapitalisierungs-Sentiment-Schwankungen; das sind Analystenschätzungen über Medien, nicht unabhängig von den beteiligten Unternehmen bestätigt.

05

Grok im Vergleich zum Feld

ModellAnbieterParameterKontextPreis (In/Out pro 1M)Quelle
Grok 4.5xAINicht veröffentlicht500K2 $ / 6 $xAI offiziell
Grok 4.6 (angekündigt)xAI1,5TNicht veröffentlichtNicht veröffentlichtMusks X-Post (unbestätigt)
Kimi K3Moonshot AI2,8T MoE (~16/896 aktiv)1M0,30 $ Cache / 3 $ Miss In, 15 $ OutMoonshot + Hugging Face
Claude Fable 5.1 (Gerücht)AnthropicNicht veröffentlichtNicht veröffentlichtGerücht Fable 5 (10 $/50 $)36kr, WinCentral — unbestätigt
GPT-5.6 SolOpenAINicht veröffentlichtNicht veröffentlichtNicht veröffentlichtOpenAI offiziell
06

Was Sie vor Vertrauen in diese Timeline prüfen sollten

  • Die einzige Quelle ist ein Tweet. Kein xAI-Blogpost, keine Model Card, keine Produktseite bestätigt Grok 4.6s Specs oder Datum.
  • „Musk Time“ hat Erfolgsbilanz. „Rund 7. August“ als Ziel, nicht als Garantie behandeln.
  • xAI kämpft parallel mit Safety-Kontroversen. Im Juli 2026 verklagte xAI einen Nutzer wegen angeblicher CSAM-Generierung mit Grok — erste Klage dieser Art. Ein Common-Sense-Media-Bericht von Januar 2026 stufte Grok unter die schlechtesten Chatbots für Kindersicherheit ein.
  • Timing kollidiert mit Branchen-Spaltung zum AI-Pacing. Am selben Tag wie Musks 4.6/4.7-Ankündigung unterstützten OpenAI und Anthropic „Pacing the Frontier“ auf Unternehmensebene. xAI fehlt auf der Liste.
07

August 2026 wird zum Release-Engpass

Hält Musks Timeline, landen Grok 4.6 und 4.7 im selben Monat wie das gemunkelte Claude Fable 5.1 (Leaks von 36kr und WinCentral, zeitlich vor erwartetem GPT-6) und wenige Wochen nach Kimi K3s Open-Weight-Schock. Für Teams, die Modelle evaluieren, schrumpft die Nutzungsdauer jedes Flaggschiffs auf Wochen — Token-Effizienz und reale Aufgabenkosten, nicht allein Leaderboard-Rang, werden zur dauerhafteren Entscheidungsgrundlage.

08

Fünf Schritte vor dem Launch-Tag

  1. 01

    Grok-4.5-Baseline einfrieren: Aufgabentypen, Token-Verbrauch und Kosten pro Aufgabe in Cursor/API protokollieren für Vergleichbarkeit

  2. 02

    Offizielle xAI-Kanäle beobachten: x.ai/news und @xai — nicht nur X-Antworten

  3. 03

    Kimi K3 und Fable-5.1-Gerüchte parallel verfolgen: August könnte ein Drei-Wege-Rennen werden — Szenarien priorisieren (Coding, Agenten, Long Context, Kosten)

  4. 04

    Isolierte Testumgebung bereitstellen: API-Volatilität, Quotas und Preisverschiebungen in Woche eins sind üblich

  5. 05

    Cursor-Integration in macOS-GUI-Sitzung validieren: Grok 4.5 wurde mit Cursor co-trainiert; 4.6 landet vermutlich dort zuerst — Modellwechsel und Keychain-Dialoge brauchen echten Mac-Desktop, nicht nur SSH

Zitierbare Zahlen: Grok 4.5 bei 2 $/6 $ pro M Tokens · 4.6-Ziel 1,5T · 4.7-Ziel 2,1T · Kimi K3 Frontend Code Arena 1.679 · Grok 4.5 ~15.954 vs. Opus 4.8 ~67.020 Output-Tokens pro SWE-Bench-Pro-Aufgabe.

09

FAQ

Musk nannte in einem X-Post „rund 7. August 2026“, xAI hat das Datum aber nicht offiziell bestätigt. Behandeln Sie es als Ziel, das sich verschieben kann.

Grok 4.6 hat 1,5T mit SFT/RL-Post-Training-Fokus. Grok 4.7, einige Wochen später, hat 2,1T — Musk sagt, es schlägt 4.6 überall außer Serving-Geschwindigkeit, tauscht Latenz gegen bessere Token-Effizienz.

Zu früh. Grok 4.6 hat keine veröffentlichten Benchmarks; Kimi K3 hat verifizierte Scores; Claude Fable 5.1 ist von Anthropic nicht offiziell bestätigt.

Unbekannt. Grok 4.5 startete bei 2 $/6 $ pro Mio. Input/Output — ein sinnvoller Referenzpunkt, aber xAI hat keine 4.6-Preise genannt.

Erwartet: Grok Build, xAI-API und Console zuerst, Drittplattformen wie Cursor kurz danach — basierend auf Grok 4.5, für 4.6 nicht bestätigt.

Abschluss

Grok 4.6 ist noch eine Roadmap in einem Tweet, keine Model Card — aber mit Kimi K3s Open-Weight-Schock und einem August-Stau lohnt sich jetzt eine Vergleichsbaseline mehr als Parameter-Schlagzeilen. Wenn Ihr Daily Driver Windows oder Linux ist, Sie aber Grok-Modelle in Cursor wechseln, Agent-Benchmarks fahren oder iOS-Builds parallel laufen lassen müssen: Hardware kaufen ist teuer, SSH-only klickt keine Keychain- oder Systemdialoge. Ein gemieteter VNCMac Remote-Mac gibt Ihnen einen stundenweisen VNC-Desktop zur Validierung von Grok- und OpenClaw-Multi-Modell-Workflows in Isolation. Siehe Mac-Mietpläne; Hintergrund in unserem Grok-4.5-Test und Kimi-K3-Open-Weight-Guide.

Quellen: xAI „Introducing Grok 4.5“ und Model Card (media.x.ai), Musks X-Post vom 28. Juli 2026 (Antwort an @rauchg), Chain Tech Daily / Tron Weekly, Moonshot-AI-Releases, Emergent.sh / WinCentral / 36kr zu Fable-5.1-Leaks, The Verge / TechTimes zu „Pacing the Frontier“, Ars Technica / TechCrunch zu xAI-Safety-Kontroversen. Stand 30. Juli 2026 — alle Grok-4.6/4.7-Details sind Herstellerankündigungen oder Branchenleaks; vor Verlass auf Datum, Spec oder Preis offizielle xAI-Kanäle prüfen.