大模型發布 2026年7月30日 約 18 分鐘 Grok 4.6 xAI

Grok 4.6什麼時候發布?
馬斯克預告8月7日上線,參數升至1.5萬億

7/28 Musk 回覆 @rauchg · 1.5T / 2.1T 路線圖 · SFT & RL 升級 · Kimi K3 競爭壓力 · 未證實資訊標註

Grok 4.6 xAI 大模型發布預告概念圖

摘要:馬斯克 7 月 28 日在 X 上回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發布參數規模達 1.5 萬億的 Grok 4.6,隨後幾週內還會推出 2.1 萬億參數的 Grok 4.7。這距離上一代 Grok 4.5 發布僅一個月,意味著 xAI 在今年夏天要連續推出三款前沿模型。目前官方尚未公布具體基準分數和定價,以下資訊基於馬斯克本人的公開表態及行業報導整理,未證實部分已單獨標註

01

開發者為什麼此刻要盯緊 Grok 4.6

  1. 01

    資訊源極度單一:目前唯一一手來源是馬斯克在 X 上的一條回覆,尚無 xAI 官方部落格、模型卡或定價頁

  2. 02

    「Musk time」有彈性:xAI、Tesla、SpaceX 的歷史時間表常有數天到數週延遲,不能把「約 8 月 7 日」當硬承諾

  3. 03

    競品窗口極短:Kimi K3 剛全面開源震動行業,傳聞中的 Claude Fable 5.1 也指向 8 月——選型週期被壓縮到數週

  4. 04

    基準與定價全空白:與 Grok 4.5 發布時詳盡的模型卡不同,4.6/4.7 目前沒有任何第三方獨立評測

  5. 05

    安全合規陰影仍在:xAI 7 月就 CSAM 相關訴訟與未成年人保護爭議未平,企業選型需同時評估技術能力與供應商風險

02

時間線:從 Grok 4.5 到 4.6、4.7,節奏有多快

日期事件
2026年7月8日xAI 正式發布 Grok 4.5,定位為「專為編程與智能體任務打造」的旗艦模型,與 Cursor 合作、使用真實開發者會話數據訓練,支援 50 萬 token 上下文,定價為每百萬 token 輸入 $2 / 輸出 $6
2026年7月16日競品 Moonshot AI(月之暗面)的 Kimi K3 以託管服務形式上線
2026年7月26日Kimi K3 提前一天放出完整開源權重:2.8 萬億參數、100 萬 token 上下文
2026年7月28日馬斯克在回覆 Rauch 的貼文中首次公開 Grok 4.6 和 4.7 的路線圖與大致時間表——本文資訊的主要來源
約 2026年8月7日(目標)Grok 4.6 計畫發布,1.5 萬億參數,重點在 SFT 與 RL 層面的升級,而非單純堆參數
約 2026年8月末至9月初(預估)Grok 4.7 計畫跟進,2.1 萬億參數,馬斯克稱其「除了推理速度稍慢外,其他方面全面優於 4.6,且 token 效率更高」

需要提醒的是,馬斯克給出的時間表歷來存在彈性——業內常稱之為「Musk time」,實際發布日期比預告晚幾天到兩週並不罕見,發布前建議以 xAI 官方帳號或官網公告為準。

03

核心數據一覽

模型發布/目標時間參數規模定位重點狀態
Grok 4.3 Beta2026年4月17日未公開上一代基線已發布
Grok 4.52026年7月8日未公開(非 MoE 單一 SKU)編程與智能體任務,與 Cursor 聯合訓練已發布
Grok 4.6約 2026年8月7日1.5 萬億SFT/RL 大幅升級官方預告,未發布
Grok 4.7約 2026年8月末–9月初2.1 萬億全面優於 4.6,token 效率更高官方預告,未發布

註:參數規模、定價、基準分數均為廠商/馬斯克自述,Grok 4.6 與 4.7 目前均未有第三方獨立評測數據,表中「官方預告」資訊務必以正式發布為準。

04

深度拆解:這次升級的重點不是「更大」,而是「更會學」

SFT 和 RL 到底在解決什麼問題

監督微調(SFT)是用人工標註或精選的高品質樣本去糾正模型的輸出習慣;強化學習(RL)則是用獎勵信號讓模型在真實任務鏈路中學會「怎麼做才對」,尤其是多步驟的智能體任務。馬斯克特意強調 Grok 4.6 的升級重點在「SFT & RL」而非參數規模本身,這與 Grok 4.5 的打法是延續的——Grok 4.5 當時憑藉與 Cursor 合作獲取的真實開發者會話數據,在保持較小輸出 token 消耗的情況下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成績,處理同類任務所用的輸出 token 數量遠低於 Claude Opus 4.8(約 1.9 萬 token 對 6.7 萬 token)。

為什麼 xAI 選擇「參數堆量 + 後訓練精修」兩條腿走路

Grok 4.6 的 1.5 萬億參數相比 Grok 4.5 是明顯的規模躍升,但馬斯克沒有迴避「參數不是唯一變數」這一點——他隨後補充說 Grok 4.7 會更大(2.1 萬億)卻「推理稍慢」,暗示 xAI 內部很清楚參數規模和推理速度之間存在權衡,未來會用兩款不同定位的模型分別滿足「更強」和「更快」的需求,而不是用一個模型通吃所有場景。

與 Kimi K3 同期競爭帶來的現實壓力

Grok 4.6 的發布時間表恰好卡在 Kimi K3 全面開源引發行業震動之後的第 10 天左右。Kimi K3 在 Frontend Code Arena 編程榜單上以 1679 分登頂,成為首個超越所有閉源模型的開源模型,Artificial Analysis 智能指數綜合排名全球第三。馬斯克本人也在 Kimi K3 相關評測下留言稱「令人印象深刻」。業內普遍解讀,xAI 加快 Grok 4.6/4.7 發布節奏,與 OpenAI、Anthropic 及中國廠商的競爭烈度上升直接相關。

05

橫向對比:Grok 系列 vs 同期競品

模型廠商參數規模上下文視窗定價(輸入/輸出,每百萬 token)關鍵數據來源
Grok 4.5xAI未公開50 萬 token$2 / $6xAI 官方公告
Grok 4.6(預告)xAI1.5 萬億未公開未公開馬斯克 X 貼文(未經第三方驗證)
Kimi K3月之暗面2.8 萬億(MoE,激活約 16/896 專家)100 萬 token$0.30(快取命中)/$3(快取未命中)輸入,$15 輸出Moonshot 官方 + Hugging Face
Claude Fable 5.1(傳聞)Anthropic未公開未公開傳聞維持 Fable 5 定價($10 輸入/$50 輸出)36kr、WinCentral 爆料,Anthropic 未確認
GPT-5.6 SolOpenAI未公開未公開未公開OpenAI 官方公告

表格中 Grok 4.6、Claude Fable 5.1 相關數據均為預告或傳聞,不構成正式基準對比,僅供參考發布節奏和大致定位。

06

爭議點與需要注意的細節

  • 時間表本身未經第三方驗證:目前唯一資訊源是馬斯克在 X 上的一條回覆貼,xAI 官方部落格和產品頁尚未同步公告,實際日期存在提前或推遲的可能。
  • 基準分數與定價全部空白:與 Grok 4.5 發布時詳細的模型卡、基準表不同,Grok 4.6 目前沒有任何獨立測評或官方模型卡佐證其能力。
  • xAI 近期的內容安全爭議:就在 Grok 4.6 預告前不久,xAI 於 7 月對一名使用者提起訴訟,指控其利用 Grok 繞過安全限制生成兒童性虐待材料(CSAM)。今年 1 月,Common Sense Media 的報告曾將 Grok 評為「未成年人保護最差的 AI 產品之一」。
  • 與行業「減速」呼籲的錯位時間點:7 月 28 日——馬斯克發布 Grok 4.6/4.7 路線圖的同一天,OpenAI、Anthropic 等公司 1200 餘名員工聯署了「Pacing the Frontier」公開信,呼籲美國政府建立主動放緩前沿 AI 發展的治理工具,OpenAI 和 Anthropic 均以公司名義背書。xAI 並未出現在簽署名單中。
07

影響與背景:2026 年 8 月會是「扎堆發布月」

如果馬斯克的時間表成立,Grok 4.6、Grok 4.7 將與傳聞中的 Claude Fable 5.1(據 36kr、WinCentral 等多方爆料指向 8 月,且 Anthropic 意圖搶在 OpenAI GPT-6 之前上線)在同一個月內相繼登場,疊加 7 月已經開源的 Kimi K3 帶來的開源模型衝擊,2026 年 8 月很可能成為大模型發布密度最高的月份之一。對開發者和企業使用者而言,這意味著選型窗口期極短——上一代旗艦可能剛上線一個月就要面對新一代競品,性價比和 token 效率(而非單純的參數規模或跑分)會是更實際的決策依據。

08

發布前 5 步:開發者可執行的驗收準備

  1. 01

    凍結當前 Grok 4.5 基線:記錄你在 Cursor / API 上的任務類型、平均 token 消耗與單次任務成本,便於 4.6 發布後做同任務對照

  2. 02

    關注 xAI 官方渠道:訂閱 x.ai/news 與 @xai 帳號,不要僅憑 X 回覆判斷上線時間

  3. 03

    並行追蹤 Kimi K3 與 Fable 5.1 傳聞:8 月可能是三強同台,提前列出你的場景優先級(編程 / Agent / 長上下文 / 成本)

  4. 04

    準備隔離測試環境:新模型首週 API 波動、配額與定價調整常見,避免直接切生產流量

  5. 05

    在 macOS 圖形工作階段中驗收 Cursor 整合:Grok 4.5 與 Cursor 聯合訓練,4.6 大概率仍優先落地 Cursor——需要真實 macOS + VNC 圖形介面完成模型切換、鑰匙圈與權限核對

可引用數據:Grok 4.5 定價 $2/$6 per M tokens · 4.6 目標 1.5T · 4.7 目標 2.1T · Kimi K3 Frontend Code Arena 1679 分 · Grok 4.5 SWE-Bench Pro 64.7% vs Opus 4.8 約 1.9 萬 vs 6.7 萬輸出 token/任務。

09

常見問題(FAQ)

馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期,實際時間可能提前或延後。

Grok 4.6 為 1.5 萬億參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 萬億參數,預計在 4.6 發布後「幾週」跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。

目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測數據且在部分編程榜單上表現突出,Claude Fable 5.1 本身尚未被 Anthropic 官方確認發布,三者暫無法直接對比。

官方未公布。可參考 Grok 4.5 的定價(輸入 $2/輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整,務必以正式發布資訊為準。

按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入更多第三方平台(如 Cursor),但具體入口以正式發布公告為準。

結語

Grok 4.6 目前仍是一條貼文裡的路線圖,而非帶模型卡的正式產品——但在 Kimi K3 開源衝擊與 8 月多強同台預期下,等待官方公告的同時做好對照基線,比追逐參數數字更務實。若你主力機是 Windows/Linux,卻要在 Cursor 裡第一時間切換 Grok 4.6、跑 Agent 基準或並行做 iOS 建置,自購 Mac 成本高、純 SSH 又點不了鑰匙圈與系統權限彈窗。租用 VNCMac 遠端 Mac 可按小時開通 VNC 桌面,在隔離節點上驗收 Grok 與 OpenClaw 多模型工作流。查看 Mac Mini M4 套餐;更多背景可參考站內 Grok 4.5 深度評測Kimi K3 全面開源

數據來源:xAI 官方部落格《Introducing Grok 4.5》及 Grok 4.5 模型卡(media.x.ai)、馬斯克 2026 年 7 月 28 日 X 貼文(回覆 @rauchg)、Chain Tech Daily / Tron Weekly 等報導、Moonshot AI 官方發布、Emergent.sh / WinCentral / 36kr 關於 Claude Fable 5.1 傳聞、The Verge / TechTimes 關於「Pacing the Frontier」公開信、Ars Technica / TechCrunch 關於 xAI 安全爭議。以上資訊截至 2026 年 7 月 30 日,Grok 4.6/4.7 相關細節均為官方預告或行業傳聞,發布前請務必以 xAI 官方渠道核實最新數據。