LLM リリース 2026年7月30日 約 18 分 Grok 4.6 xAI

Grok 4.6 発売日:
xAI の 8 月 7 日ターゲットは現実的か?

7/28 マスク氏 @rauchg への返信 · 1.5T / 2.1T ロードマップ · SFT & RL 強化 · Kimi K3 競争 · 未確認情報を明示

Grok 4.6 xAI 大規模言語モデル リリース予告の概念図

要約:イーロン・マスク氏は Grok 4.6 が「8 月 7 日頃」に登場し、数週間後に大規模な Grok 4.7 が続くと述べています。2026 年 7 月 28 日、Vercel CEO Guillermo Rauch 氏への X 上の返信でロードマップが共有されました——xAI 公式発表ではありません。Benchmark、料金、モデルカードはいずれも未公開です。本稿では記録に残る事実とベンダー主張・業界リークを切り分け、未確認の詳細は明示します。

01

開発者が今すぐ注目すべき理由

  1. 01

    単一ソースリスク:一次情報は X 上の 1 件の返信のみ——xAI ブログ投稿、モデルカード、料金ページはまだありません

  2. 02

    「Musk time」のズレ:xAI、Tesla、SpaceX のタイムラインは歴史的に数日〜数週間遅延しています

  3. 03

    評価ウィンドウの圧縮:Kimi K3 が完全オープンウェイト化。噂の Claude Fable 5.1 も 8 月を指しています

  4. 04

    Benchmark と料金が空白:Grok 4.5 の詳細なモデルカードと異なり、4.6/4.7 には第三者検証がゼロです

  5. 05

    セーフティ関連の報道:xAI の 7 月 CSAM 訴訟と児童保護評価は、生の能力とは別軸のエンタープライズリスクです

02

確認済み情報 vs マスク氏の発言

日付出来事
2026年7月8日xAI が Grok 4.5 を出荷——コーディング/Agentic 特化、Cursor と共同訓練。500K コンテキスト、入力 $2/出力 $6 per M tokens、15 件の Benchmark スコア付きモデルカード公開
2026年7月16日〜26日Moonshot AI の Kimi K3 がホストプレビューから完全オープンウェイト(2.8T、1M コンテキスト)へ。Hugging Face トレンド首位。マスク氏は Benchmark コメント欄で称賛
2026年7月28日マスク氏が Rauch 氏への返信で Grok 4.6/4.7 ロードマップを投稿。同日、OpenAI・Anthropic・Google DeepMind・Meta の 1,200 名超が「Pacing the Frontier」公開書簡を発表
約 2026年8月7日(目標)Grok 4.6、1.5T パラメータ。生のスケールアップより SFT/RL アップグレードとして位置づけ
2026年8月末〜9月初旬(推定)Grok 4.7、2.1T パラメータ——マスク氏は「4.6 よりあらゆる面で優れるが、配信はやや遅い。Token 効率はさらに高い」と述べています
03

現時点の数値

モデル日付パラメータ重点ステータス
Grok 4.3 Beta2026年4月17日非公開ベースライン出荷済み
Grok 4.52026年7月8日非公開(単一 SKU)コーディング/Agentic、Cursor 共同訓練出荷済み、Benchmark あり
Grok 4.6約 2026年8月7日1.5TSFT/RL アップグレードツイートで告知、未出荷
Grok 4.7約 8 月末〜9 月初旬2.1T総合アップグレード、Token 効率向上ツイートで告知、未出荷

Grok 4.6/4.7 の数値はすべて単一 SNS 投稿に基づく未検証のベンダー主張です——方向性として扱い、確定スペックとは見なさないでください。

04

xAI がスケールだけでなくポストトレーニングを強調する理由

教師あり微調整(SFT)は厳選例で振る舞いを形作り、強化学習(RL)は実際の多段階 Agentic タスクで有効な行動列を学ばせます。マスク氏の「SFT & RL を大幅改善」という表現は、Grok 4.5 の戦略を継続するシグナルです——SWE-Bench Pro タスクあたり出力 Token 約 15,954 対 Opus 4.8 の 67,0204.2 倍の効率差は、モデルサイズではなく Cursor 開発者セッション上のポストトレーニングの成果とされています。

Grok 4.6 の 1.5T への拡大は実質的なスケール増ですが、4.7 がより大きく(2.1T)「配信速度以外はあらゆる面で 4.6 より優れる」とマスク氏が述べた点は、レイテンシと品質のトレードオフが異なる 2 SKU——Anthropic の Sonnet/Opus 分離や OpenAI の mini/full ティアに近い構図を示唆します。

競争背景として、Grok 4.6 の目標日は Kimi K3 オープンウェイトショックの約 10 日後です。K3 は Frontend Code Arena で 1,679 点——同ボードで初めて全クローズドモデルを上回ったオープンウェイト——Artificial Analysis Intelligence Index では 3 位。中国系金融メディアはリリースをめぐる時価総額センチメントの大きな変動を報じましたが、これらはアナリスト推計のメディア経由中継であり、関係各社による独立確認ではありません。

05

競合との比較

モデルベンダーパラメータコンテキスト料金(入力/出力 per 1M)出典
Grok 4.5xAI非公開500K$2 / $6xAI 公式
Grok 4.6(告知)xAI1.5T非公開非公開マスク氏 X 投稿(未検証)
Kimi K3Moonshot AI2.8T MoE(アクティブ約 16/896)1M$0.30 キャッシュヒット / $3 ミス入力、$15 出力Moonshot + Hugging Face
Claude Fable 5.1(噂)Anthropic非公開非公開噂:Fable 5 同額($10/$50)36kr、WinCentral——未確認
GPT-5.6 SolOpenAI非公開非公開非公開OpenAI 公式
06

このタイムラインを鵜呑みにする前に確認すべき点

  • 唯一の情報源はツイートです。xAI ブログ、モデルカード、製品ページは Grok 4.6 のスペックや日付を確認していません。
  • 「Musk time」には実績があります。「8 月 7 日頃」は保証ではなく目標として扱ってください。
  • xAI は別線でセーフティ論争に直面しています。2026 年 7 月、xAI は Grok を使って CSAM を生成したとされるユーザーを提訴——同社初のこの種の訴訟です。2026 年 1 月の Common Sense Media 報告は Grok を児童保護リスクが最も高いチャットボットの一つと評価しました。
  • タイミングが業界の AI ペーシング論争と重なります。マスク氏が 4.6/4.7 を告知した同日、OpenAI と Anthropic は企業レベルで「Pacing the Frontier」に署名。xAI は署名者リストに含まれていません。
07

2026 年 8 月はリリース集中月になりつつあります

マスク氏のタイムラインが守られれば、Grok 4.6 と 4.7 は噂の Claude Fable 5.1(36kr・WinCentral リーク、GPT-6 先取りを狙う 8 月)と同月に、Kimi K3 オープンウェイトショックの数週間後に登場します。モデル評価チームにとって、単一フラッグシップの有用寿命は数週単位に圧縮——Token 効率と実タスクコストが、リーダーボード順位単独より durable な選定基準になります。

08

ローンチ前の 5 ステップ

  1. 01

    Grok 4.5 ベースラインを固定:Cursor/API でタスク種別、Token 使用量、タスクあたりコストを記録し、同条件比較の土台を作ります

  2. 02

    xAI 公式チャネルを監視:x.ai/news と @xai——X 返信だけに依存しないでください

  3. 03

    Kimi K3 と Fable 5.1 噂を並行追跡:8 月は三社競争の可能性——コーディング、Agent、長コンテキスト、コストの優先順位を先に決めます

  4. 04

    隔離テスト環境を用意:初週の API 変動、クォータ、料金変更はよくあります

  5. 05

    macOS GUI セッションで Cursor 連携を検証:Grok 4.5 は Cursor と共同訓練。4.6 も先行投入の可能性が高く——モデル切替と Keychain プロンプトには SSH だけでは不十分な実 Mac デスクトップが必要です

引用可能な数値:Grok 4.5 $2/$6 per M tokens · 4.6 目標 1.5T · 4.7 目標 2.1T · Kimi K3 Frontend Code Arena 1,679 · Grok 4.5 約 15,954 vs Opus 4.8 約 67,020 出力 Token / SWE-Bench Pro タスク。

09

よくある質問(FAQ)

マスク氏は X 投稿で「2026年8月7日頃」と述べていますが、xAI による公式確認はありません。前後する可能性のある目標日として扱ってください。

Grok 4.6 は 1.5T で SFT/RL ポストトレーニングが中心です。Grok 4.7 は数週間後に 2.1T——マスク氏は配信速度以外は 4.6 を上回るが、レイテンシと引き換えに Token 効率がさらに高いと述べています。

現時点では判断できません。Grok 4.6 には公開 Benchmark がありません。Kimi K3 は検証済みスコアを持ち、Claude Fable 5.1 は Anthropic による公式確認すらありません。

未公開です。Grok 4.5 は入力 $2/M、出力 $6/M tokens でローンチ——妥当な参考値ですが、xAI は 4.6 の料金を開示していません。

Grok 4.5 の展開実績から、Grok Build、xAI API、コンソールが先行し、Cursor など第三者プラットフォームが続くと予想されます——4.6 については未確認です。

おわりに

Grok 4.6 はまだツイート内のロードマップであり、モデルカードではありません——ただし Kimi K3 のオープンウェイトショックと 8 月の集中リリースが迫る中、今から比較ベースラインを構築する方がパラメータ見出しを追うより実用的です。主力機が Windows や Linux でも、Cursor で Grok モデルを切り替え、Agent Benchmark を走らせ、iOS ビルドを並行する必要がある場合、Mac 購入は高コストで、SSH のみでは Keychain やシステム権限ダイアログを操作できません。VNCMac リモート Mac を時間課金でレンタルすれば、VNC デスクトップで Grok と OpenClaw 多モデルワークフローを隔離検証できます。Mac レンタルプランをご覧ください。背景はGrok 4.5 レビューKimi K3 オープンウェイト解説も参照してください。

出典:xAI「Introducing Grok 4.5」およびモデルカード(media.x.ai)、マスク氏 2026年7月28日 X 投稿(@rauchg への返信)、Chain Tech Daily / Tron Weekly 報道、Moonshot AI リリース、Emergent.sh / WinCentral / 36kr の Fable 5.1 リーク、The Verge / TechTimes の「Pacing the Frontier」、Ars Technica / TechCrunch の xAI セーフティ論争。情報は 2026年7月30日時点。Grok 4.6/4.7 の詳細はすべてベンダー告知または業界リークです——日付・スペック・価格を依存する前に xAI 公式チャネルでご確認ください。