Grok 4.6 什么时候发布?马斯克预告 8 月 7 日上线,参数升至 1.5 万亿
谁遇到什么问题?在 Cursor 等平台使用 Grok 4.5 的 Mac 开发者,面对马斯克 7 月 28 日披露的 4.6/4.7 双型号路线图,不确定时间表是否可靠、是否值得等待升级。本文给什么?基于马斯克公开表态与行业报道的时间线、参数表、竞品对照,并明确标注未证实信息。结构包含:三大痛点、时间线、双表对比、SFT/RL 拆解、五步 Mac 隔离准备、FAQ×5。
📋 本文目录
Grok 4.5 实测与定价见 Grok 4.5 深度评测;Kimi K3 开源背景见 Kimi K3 全面开源。
马斯克 7 月 28 日在 X 上回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿的 Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7。这距离上一代 Grok 4.5 发布仅一个月,意味着 xAI 在今年夏天要连续推出三款前沿模型。目前官方尚未公布具体基准分数和定价,以下信息基于马斯克本人的公开表态及行业报道整理。
01 · 三大决策痛点:为什么「8 月 7 日」不能当官宣日期
- 信息源单一:Grok 4.6 的日期、参数与升级重点目前仅来自马斯克一条 X 回复,xAI 官方博客与产品页尚未同步公告——与 Grok 4.5 发布时附完整模型卡的做法形成鲜明对比。
- Musk time 弹性:业内对马斯克时间表「晚几天到两周」早有预期;若你的团队排期绑定 8 月 7 日切换生产模型,可能面临空窗期与重复验收成本。
- 竞品窗口极短:Kimi K3 于 7 月 26 日全面开源、Claude Fable 5.1 传闻指向 8 月——在 Grok 4.6 尚无 benchmark 的当下,「等 4.6」与「先用 K3/OpenRouter 分层路由」是两条真实分叉的决策路径。
02 · 时间线:从 Grok 4.5 到 4.6、4.7,节奏有多快
- 2026 年 7 月 8 日:xAI 正式发布 Grok 4.5,定位为「专为编程与智能体任务打造」的旗舰模型,与 Cursor 合作、使用真实开发者会话数据训练,支持 50 万 token 上下文,定价为每百万 token 输入 $2 / 输出 $6。
- 2026 年 7 月 16–26 日:Moonshot AI 的 Kimi K3 从托管服务到完整开源权重(2.8 万亿参数、100 万 token 上下文),在 Frontend Code Arena 以 1679 分登顶,马斯克在相关评测下留言称「令人印象深刻」。
- 2026 年 7 月 28 日:马斯克在回复 Rauch 的帖子中首次公开 Grok 4.6 和 4.7 的路线图与大致时间表;同日 OpenAI、Anthropic 等 1200 余名员工联署「Pacing the Frontier」公开信,呼吁放缓前沿 AI 发展,xAI 未出现在签署名单中。
- 约 2026 年 8 月 7 日(目标):Grok 4.6 计划发布,1.5 万亿参数,重点在 SFT 与 RL 层面的升级,而非单纯堆参数。
- 约 2026 年 8 月末至 9 月初(预估):Grok 4.7 计划跟进,2.1 万亿参数,马斯克称其「除了推理速度稍慢外,其他方面全面优于 4.6,且 token 效率更高」。
03 · 核心数据一览
| 模型 | 发布/目标时间 | 参数规模 | 定位重点 | 状态 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026-04-17 | 未公开 | 上一代基线 | 已发布 |
| Grok 4.5 | 2026-07-08 | 未公开 | 编程与智能体,与 Cursor 联合训练 | 已发布 |
| Grok 4.6 | 约 2026-08-07 | 1.5 万亿 | SFT/RL 大幅升级 | 官方预告,未发布 |
| Grok 4.7 | 约 8 月末–9 月初 | 2.1 万亿 | 全面优于 4.6,token 效率更高 | 官方预告,未发布 |
注:参数规模、定价、基准分数均为厂商/马斯克自述,Grok 4.6 与 4.7 目前均未有第三方独立评测数据。
04 · 深度拆解:这次升级的重点不是「更大」,而是「更会学」
4.1 SFT 和 RL 到底在解决什么问题
监督微调(SFT)是用人工标注或精选的高质量样本纠正模型输出习惯;强化学习(RL)则用奖励信号让模型在真实任务链路中学会「怎么做才对」,尤其是多步骤的智能体任务。马斯克特意强调 Grok 4.6 的升级重点在「SFT & RL」而非参数规模本身,这与 Grok 4.5 的打法延续——Grok 4.5 凭借与 Cursor 合作获取的真实开发者会话数据,在 SWE-Bench Pro 上拿到 64.7% 的同时,处理同类任务输出 token 约 15,954,远低于 Claude Opus 4.8 的约 67,020(约 4.2 倍效率差)。
硬核数据点 #1:Grok 4.6 预告参数 1.5 万亿,较 4.5 是明显规模跃升,但马斯克同时预告 4.7 为 2.1 万亿且「推理稍慢」——暗示 xAI 用两款 SKU 分别满足「更强」与「更快」场景。
4.2 与 Kimi K3 同期竞争带来的现实压力
Grok 4.6 的目标发布日落在 Kimi K3 全面开源后约第 10 天。Kimi K3 在 Artificial Analysis 智能指数综合排名第三,成为首个在部分编程榜单超越所有闭源模型的开源权重产品。业内普遍解读,xAI 加快 4.6/4.7 节奏与 OpenAI、Anthropic 及中国厂商竞争烈度上升直接相关。
硬核数据点 #2:Kimi K3 为 2.8 万亿 MoE(激活约 16/896 专家)、100 万 token 上下文;Grok 4.6 上下文与定价目前全部空白,无法做总拥有成本(TCO)精算。
05 · 横向对比:Grok 系列 vs 同期竞品
| 模型 | 厂商 | 参数规模 | 上下文 | 定价(输入/输出,$/M) |
|---|---|---|---|---|
| Grok 4.5 | xAI | 未公开 | 50 万 token | $2 / $6 |
| Grok 4.6(预告) | xAI | 1.5 万亿 | 未公开 | 未公开 |
| Kimi K3 | 月之暗面 | 2.8 万亿 MoE | 100 万 token | $0.30–$3 / $15 |
| Claude Fable 5.1(传闻) | Anthropic | 未公开 | 未公开 | 传闻 $10 / $50 |
| GPT-5.6 Sol | OpenAI | 未公开 | 未公开 | 未公开 |
硬核数据点 #3:Grok 4.5 已验证 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%;4.6 目前零公开 benchmark——发布前任何「碾压 K3」的结论都缺乏数据支撑。
06 · 争议点与需要注意的细节
- 时间表未经第三方验证:唯一信息源是马斯克 X 回复,实际日期可能提前或推迟。
- 基准与定价全部空白:「1.5 万亿参数」与「SFT/RL 大幅升级」目前均为厂商单方面说法。
- xAI 内容安全争议:7 月 xAI 起诉用户涉嫌利用 Grok 绕过安全限制生成 CSAM;Common Sense Media 曾将 Grok 评为未成年人保护最差的 AI 产品之一——不影响技术评价,但涉及企业合规投入。
- 行业「减速」与 xAI「加速」错位:7 月 28 日马斯克公布路线图同日,OpenAI 与 Anthropic 公司层面背书「Pacing the Frontier」——战略分裂本身值得持续观察。
07 · 影响与背景:2026 年 8 月会是「扎堆发布月」
若马斯克时间表成立,Grok 4.6、Grok 4.7 将与传闻中的 Claude Fable 5.1(多方爆料指向 8 月)在同月登场,叠加 7 月 Kimi K3 开源冲击,2026 年 8 月很可能成为大模型发布密度最高的月份之一。对开发者和企业用户而言,选型窗口期极短——上一代旗舰可能刚上线一个月就要面对新一代竞品,token 效率与真实任务成本(而非单纯参数或跑分)会是更实际的决策依据。
08 · 五步 Mac 隔离准备:在 4.6 落地前建好验收环境
- 在隔离 Mac 上固定当前 Grok 4.5 baseline:同一仓库跑 3 类任务(修 bug / 小功能 / 多文件重构),记录 token 消耗与账单。
- 配置
console.x.aiAPI Key 至独立 shell 配置或临时环境变量,避免写入主力机全局.zshrc。 - 在 Cursor 模型选择器中锁定 Grok 4.5,并设置 OpenRouter fallback 路由(参考 OpenRouter 接入教程),防止 4.6 延期导致生产空窗。
- 建立「发布日核对清单」:模型卡、benchmark、定价、上下文窗口、Cursor 接入公告——四项齐全再切换默认模型。
- 4.6 上线后于同一隔离节点重复 baseline 任务,对比 diff 质量与每任务美元成本,再决定是否推广到团队主力机。
09 · 常见问题 FAQ
Q:Grok 4.6 具体是哪天发布?
A:马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。
Q:Grok 4.6 和 Grok 4.7 有什么区别?
A:Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后几周跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。
Q:Grok 4.6 会比 Kimi K3 或 Claude Fable 5.1 更强吗?
A:目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据,Claude Fable 5.1 尚未被 Anthropic 官方确认,三者暂无法直接对比。
Q:Grok 4.6 大概会怎么定价?
A:官方未公布。可参考 Grok 4.5(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代定价可能调整,务必以正式发布为准。
Q:普通用户届时能在哪里用上 Grok 4.6?
A:按 Grok 4.5 路径推测,大概率先上线 Grok Build、xAI API 和控制台,随后接入第三方平台,具体以正式公告为准。
10 · 租用隔离 Mac:在 Grok 4.6 落地前完成 Agent 工作流验收
等待 Grok 4.6 的数周里,最稳妥的做法不是冻结团队选型,而是在隔离的 Apple Silicon 节点上维持 Grok 4.5 baseline,并预配置 OpenRouter 多模型 fallback。若在主力 MacBook 上反复切换 API Key、模型默认值与 Agent 配置,常见风险包括:实验性路由写入全局环境、与 Claude/GPT 混用时的上下文策略无法单独验证、以及 4.6 延期时的生产空窗。
Windows 或 Linux 用户虽可通过 Cursor Web 部分体验 Grok,但难以完整验证与 macOS Keychain、Xcode 侧车项目并存的场景。按天租用的 M 系列 Mac mini 提供用完即毁的隔离环境:4.6 发布日重复 baseline 任务后,再决定是否推广到主力机。计费见 M 系列 Mac 算力租赁定价。
虽然你可以在现有笔记本上直接等待 4.6,但主力机更适合稳定交付;若你追求可复现的发布日验收结论与更低的 Keychain 污染风险,隔离 Mac 试跑通常是更优解,而租赁能进一步降低前期硬件投入。
11 · 数据来源
- xAI 官方博客《Introducing Grok 4.5》及 Grok 4.5 模型卡(media.x.ai)
- 马斯克 2026 年 7 月 28 日 X 帖子(回复 @rauchg)
- Chain Tech Daily、Tron Weekly、American Bazaar、Qazinform 等对该帖子的报道
- Moonshot AI 官方发布及 GitHub 仓库 moonshotai/Kimi-K3
- Emergent.sh、WinCentral、36kr 关于 Claude Fable 5.1 传闻的报道
- The Verge、TechTimes 关于「Pacing the Frontier」公开信的报道
- Ars Technica、TechCrunch、The Guardian 关于 xAI 安全争议的报道
以上信息截至 2026 年 7 月 30 日。Grok 4.6/4.7 相关细节均为官方预告或行业传闻,发布前请务必以 xAI 官方渠道核实。