7/28 Musk 回复 @rauchg · 1.5T / 2.1T 路线图 · SFT & RL 升级 · Kimi K3 竞争压力 · 未证实信息标注
摘要:马斯克 7 月 28 日在 X 上回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿的 Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7。这距离上一代 Grok 4.5 发布仅一个月,意味着 xAI 在今年夏天要连续推出三款前沿模型。目前官方尚未公布具体基准分数和定价,以下信息基于马斯克本人的公开表态及行业报道整理,未证实部分已单独标注。
信息源极度单一:目前唯一一手来源是马斯克在 X 上的一条回复,尚无 xAI 官方博客、模型卡或定价页
「Musk time」有弹性:xAI、Tesla、SpaceX 的历史时间表常有数天到数周延迟,不能把「约 8 月 7 日」当硬承诺
竞品窗口极短:Kimi K3 刚全面开源震动行业,传闻中的 Claude Fable 5.1 也指向 8 月——选型周期被压缩到数周
基准与定价全空白:与 Grok 4.5 发布时详尽的模型卡不同,4.6/4.7 目前没有任何第三方独立评测
安全合规阴影仍在:xAI 7 月就 CSAM 相关诉讼与未成年人保护争议未平,企业选型需同时评估技术能力与供应商风险
| 日期 | 事件 |
|---|---|
| 2026年7月8日 | xAI 正式发布 Grok 4.5,定位为「专为编程与智能体任务打造」的旗舰模型,与 Cursor 合作、使用真实开发者会话数据训练,支持 50 万 token 上下文,定价为每百万 token 输入 $2 / 输出 $6 |
| 2026年7月16日 | 竞品 Moonshot AI(月之暗面)的 Kimi K3 以托管服务形式上线 |
| 2026年7月26日 | Kimi K3 提前一天放出完整开源权重:2.8 万亿参数、100 万 token 上下文 |
| 2026年7月28日 | 马斯克在回复 Rauch 的帖子中首次公开 Grok 4.6 和 4.7 的路线图与大致时间表——本文信息的主要来源 |
| 约 2026年8月7日(目标) | Grok 4.6 计划发布,1.5 万亿参数,重点在 SFT 与 RL 层面的升级,而非单纯堆参数 |
| 约 2026年8月末至9月初(预估) | Grok 4.7 计划跟进,2.1 万亿参数,马斯克称其「除了推理速度稍慢外,其他方面全面优于 4.6,且 token 效率更高」 |
需要提醒的是,马斯克给出的时间表历来存在弹性——业内常称之为「Musk time」,实际发布日期比预告晚几天到两周并不罕见,发布前建议以 xAI 官方账号或官网公告为准。
| 模型 | 发布/目标时间 | 参数规模 | 定位重点 | 状态 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026年4月17日 | 未公开 | 上一代基线 | 已发布 |
| Grok 4.5 | 2026年7月8日 | 未公开(非 MoE 单一 SKU) | 编程与智能体任务,与 Cursor 联合训练 | 已发布 |
| Grok 4.6 | 约 2026年8月7日 | 1.5 万亿 | SFT/RL 大幅升级 | 官方预告,未发布 |
| Grok 4.7 | 约 2026年8月末–9月初 | 2.1 万亿 | 全面优于 4.6,token 效率更高 | 官方预告,未发布 |
注:参数规模、定价、基准分数均为厂商/马斯克自述,Grok 4.6 与 4.7 目前均未有第三方独立评测数据,表中「官方预告」信息务必以正式发布为准。
监督微调(SFT)是用人工标注或精选的高质量样本去纠正模型的输出习惯;强化学习(RL)则是用奖励信号让模型在真实任务链路中学会「怎么做才对」,尤其是多步骤的智能体任务。马斯克特意强调 Grok 4.6 的升级重点在「SFT & RL」而非参数规模本身,这与 Grok 4.5 的打法是延续的——Grok 4.5 当时凭借与 Cursor 合作获取的真实开发者会话数据,在保持较小输出 token 消耗的情况下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成绩,处理同类任务所用的输出 token 数量远低于 Claude Opus 4.8(约 1.9 万 token 对 6.7 万 token)。
Grok 4.6 的 1.5 万亿参数相比 Grok 4.5 是明显的规模跃升,但马斯克没有回避「参数不是唯一变量」这一点——他随后补充说 Grok 4.7 会更大(2.1 万亿)却「推理稍慢」,暗示 xAI 内部很清楚参数规模和推理速度之间存在权衡,未来会用两款不同定位的模型分别满足「更强」和「更快」的需求,而不是用一个模型通吃所有场景。
Grok 4.6 的发布时间表恰好卡在 Kimi K3 全面开源引发行业震动之后的第 10 天左右。Kimi K3 在 Frontend Code Arena 编程榜单上以 1679 分登顶,成为首个超越所有闭源模型的开源模型,Artificial Analysis 智能指数综合排名全球第三。马斯克本人也在 Kimi K3 相关评测下留言称「令人印象深刻」。业内普遍解读,xAI 加快 Grok 4.6/4.7 发布节奏,与 OpenAI、Anthropic 及中国厂商的竞争烈度上升直接相关。
| 模型 | 厂商 | 参数规模 | 上下文窗口 | 定价(输入/输出,每百万 token) | 关键数据来源 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 未公开 | 50 万 token | $2 / $6 | xAI 官方公告 |
| Grok 4.6(预告) | xAI | 1.5 万亿 | 未公开 | 未公开 | 马斯克 X 帖子(未经第三方验证) |
| Kimi K3 | 月之暗面 | 2.8 万亿(MoE,激活约 16/896 专家) | 100 万 token | $0.30(缓存命中)/$3(缓存未命中)输入,$15 输出 | Moonshot 官方 + Hugging Face |
| Claude Fable 5.1(传闻) | Anthropic | 未公开 | 未公开 | 传闻维持 Fable 5 定价($10 输入/$50 输出) | 36kr、WinCentral 爆料,Anthropic 未确认 |
| GPT-5.6 Sol | OpenAI | 未公开 | 未公开 | 未公开 | OpenAI 官方公告 |
表格中 Grok 4.6、Claude Fable 5.1 相关数据均为预告或传闻,不构成正式基准对比,仅供参考发布节奏和大致定位。
如果马斯克的时间表成立,Grok 4.6、Grok 4.7 将与传闻中的 Claude Fable 5.1(据 36kr、WinCentral 等多方爆料指向 8 月,且 Anthropic 意图抢在 OpenAI GPT-6 之前上线)在同一个月内相继登场,叠加 7 月已经开源的 Kimi K3 带来的开源模型冲击,2026 年 8 月很可能成为大模型发布密度最高的月份之一。对开发者和企业用户而言,这意味着选型窗口期极短——上一代旗舰可能刚上线一个月就要面对新一代竞品,性价比和 token 效率(而非单纯的参数规模或跑分)会是更实际的决策依据。
冻结当前 Grok 4.5 基线:记录你在 Cursor / API 上的任务类型、平均 token 消耗与单次任务成本,便于 4.6 发布后做同任务对照
关注 xAI 官方渠道:订阅 x.ai/news 与 @xai 账号,不要仅凭 X 回复判断上线时间
并行跟踪 Kimi K3 与 Fable 5.1 传闻:8 月可能是三强同台,提前列出你的场景优先级(编程 / Agent / 长上下文 / 成本)
准备隔离测试环境:新模型首周 API 波动、配额与定价调整常见,避免直接切生产流量
在 macOS 图形会话中验收 Cursor 集成:Grok 4.5 与 Cursor 联合训练,4.6 大概率仍优先落地 Cursor——需要真实 macOS + VNC 图形界面完成模型切换、钥匙串与权限核对
可引用数据:Grok 4.5 定价 $2/$6 per M tokens · 4.6 目标 1.5T · 4.7 目标 2.1T · Kimi K3 Frontend Code Arena 1679 分 · Grok 4.5 SWE-Bench Pro 64.7% vs Opus 4.8 约 1.9 万 vs 6.7 万输出 token/任务。
马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。
Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后「几周」跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。
目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单上表现突出,Claude Fable 5.1 本身尚未被 Anthropic 官方确认发布,三者暂无法直接对比。
官方未公布。可参考 Grok 4.5 的定价(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整,务必以正式发布信息为准。
按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入更多第三方平台(如 Cursor),但具体入口以正式发布公告为准。
Grok 4.6 目前仍是一条推文里的路线图,而非带模型卡的正式产品——但在 Kimi K3 开源冲击与 8 月多强同台预期下,等待官方公告的同时做好对照基线,比追逐参数数字更务实。若你主力机是 Windows/Linux,却要在 Cursor 里第一时间切换 Grok 4.6、跑 Agent 基准或并行做 iOS 构建,自购 Mac 成本高、纯 SSH 又点不了钥匙串与系统权限弹窗。租用 VNCMac 远程 Mac 可按小时开通 VNC 桌面,在隔离节点上验收 Grok 与 OpenClaw 多模型工作流。查看 Mac Mini M4 套餐;更多背景可参考站内 Grok 4.5 深度评测与 Kimi K3 全面开源。
数据来源:xAI 官方博客《Introducing Grok 4.5》及 Grok 4.5 模型卡(media.x.ai)、马斯克 2026 年 7 月 28 日 X 帖子(回复 @rauchg)、Chain Tech Daily / Tron Weekly 等报道、Moonshot AI 官方发布、Emergent.sh / WinCentral / 36kr 关于 Claude Fable 5.1 传闻、The Verge / TechTimes 关于「Pacing the Frontier」公开信、Ars Technica / TechCrunch 关于 xAI 安全争议。以上信息截至 2026 年 7 月 30 日,Grok 4.6/4.7 相关细节均为官方预告或行业传闻,发布前请务必以 xAI 官方渠道核实最新数据。