Grok 4.6什么时候发布?马斯克预告8月7日上线,参数升至1.5万亿

1.5T 参数 · SFT/RL 后训练升级 · Grok 4.7 路线图 · Kimi K3 竞争压力 · Musk time 弹性

Grok 4.6 发布预告与 xAI 路线图解析

马斯克 7 月 28 日在 X 上回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿的 Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7——距离 Grok 4.5 发布仅一个月,意味着 xAI 今年夏天要连续推出三款前沿模型。若你正评估 Agent 编程栈或等待下一代 API 定价,本文将交付完整时间线、Grok 系列核心数据表、竞品横向对比、SFT/RL 升级解读、争议点辨析与六步发布前研判 Runbook。目前官方尚未公布基准分数和定价,以下信息均标注来源层级。数据截止:2026-07-30

01

从 Grok 4.5 到 4.6、4.7:发布节奏有多快?

Grok 4.6 的预告并非孤立事件,而是嵌在 2026 年 7 月密集的大模型发布潮中。以下时间线是理解马斯克路线图的关键上下文:

日期事件
2026 年 7 月 8 日xAI 正式发布 Grok 4.5,定位为「专为编程与智能体任务打造」的旗舰模型,与 Cursor 合作、使用真实开发者会话数据训练,支持 50 万 token 上下文,定价为每百万 token 输入 $2 / 输出 $6
2026 年 7 月 16 日竞品 Moonshot AI(月之暗面)的 Kimi K3 以托管服务形式上线
2026 年 7 月 26 日Kimi K3 提前一天放出完整开源权重,2.8 万亿参数、100 万 token 上下文,把开源模型的规模和能力都推上新高度
2026 年 7 月 28 日马斯克在回复 Rauch 的帖子中首次公开 Grok 4.6 和 4.7 的路线图与大致时间表——本文信息的主要来源
约 2026 年 8 月 7 日(目标)Grok 4.6 计划发布,1.5 万亿参数,重点在 SFT 与 RL 层面的升级,而非单纯堆参数
约 2026 年 8 月末至 9 月初(预估)Grok 4.7 计划跟进,2.1 万亿参数,马斯克称其「除了推理速度稍慢外,其他方面全面优于 4.6,且 token 效率更高」

需要提醒的是,马斯克给出的时间表历来存在弹性——业内常称之为「Musk time」,实际发布日期比预告晚几天到两周并不罕见,发布前建议以 xAI 官方账号或官网公告为准。

围绕 Grok 4.6 预告,常见的五大认知盲区如下:

  1. 01

    把 X 帖子等同于官方发布:目前唯一信息源是马斯克在 X 上的一条回复贴,xAI 官方博客和产品页尚未同步公告,规格与日期均存在变动可能。

  2. 02

    忽视「Musk time」弹性:xAI、Tesla、SpaceX 的历史时间表常有数天到数周的延后,「大约 8 月 7 日」应视为目标而非承诺。

  3. 03

    把参数规模直接等同于能力跃升:马斯克特意强调 4.6 的升级重点在 SFT 与 RL 后训练,而非单纯堆参数;4.7 虽更大却「推理稍慢」。

  4. 04

    忽略 Kimi K3 带来的竞争背景:Grok 4.6 目标日期卡在 K3 全面开源后约 10 天,xAI 压缩发布节奏与行业竞争烈度上升直接相关。

  5. 05

    混淆行业「减速」呼吁与 xAI 加速迭代:7 月 28 日同日,OpenAI、Anthropic 等 1200 余名员工联署「Pacing the Frontier」公开信,xAI 并未出现在签署名单中。

02

核心数据一览:Grok 系列与同期竞品横向对比

Grok 系列路线图

模型发布/目标时间参数规模定位重点状态
Grok 4.3 Beta2026 年 4 月 17 日未公开上一代基线已发布
Grok 4.52026 年 7 月 8 日未公开(非 MoE 单一 SKU)编程与智能体任务,与 Cursor 联合训练已发布
Grok 4.6约 2026 年 8 月 7 日1.5 万亿SFT/RL 大幅升级官方预告,未发布
Grok 4.7约 2026 年 8 月末–9 月初2.1 万亿全面优于 4.6,token 效率更高官方预告,未发布

注:参数规模、定价、基准分数均为厂商/马斯克自述,Grok 4.6 与 4.7 目前均未有第三方独立评测数据,表中「官方预告」信息务必以正式发布为准。

横向对比:Grok 系列 vs 同期竞品

模型厂商参数规模上下文窗口定价(输入/输出,每百万 token)关键数据来源
Grok 4.5xAI未公开50 万 token$2 / $6xAI 官方公告
Grok 4.6(预告)xAI1.5 万亿未公开未公开马斯克 X 帖子(未经第三方验证)
Kimi K3月之暗面2.8 万亿(MoE,激活约 16/896 专家)100 万 token$0.30(缓存命中)/$3(缓存未命中)输入,$15 输出Moonshot 官方 + Hugging Face
Claude Fable 5.1(传闻)Anthropic未公开未公开传闻维持 Fable 5 定价($10 输入/$50 输出)36kr、WinCentral 爆料,Anthropic 未确认
GPT-5.6 SolOpenAI未公开未公开未公开OpenAI 官方公告

表格中 Grok 4.6、Claude Fable 5.1 相关数据均为预告或传闻,不构成正式基准对比,仅供参考发布节奏和大致定位。详见本站 Grok 4.5 深度评测Kimi K3 全面开源解析

马斯克强调 Grok 4.6 的升级重点在「SFT & RL」而非参数规模本身——这与 Grok 4.5 凭借与 Cursor 合作获取真实开发者会话数据、在保持较小输出 token 消耗下拿到 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 成绩的打法一脉相承。

03

六步 Runbook:Grok 4.6 发布前如何研判与准备?

无论你是 AI 开发者、技术决策者还是 Agent 工程师,在 Grok 4.6 正式落地前可按以下六步建立独立判断框架,避免被标题党带偏:

  1. 01

    核对信息源层级:区分「马斯克 X 帖子」与「xAI 官方博客/模型卡」——目前 4.6 仅有前者,无后者;在官方公告出来前,所有规格均应标注为「预告/未验证」。

  2. 02

    预留 Musk time 弹性窗口:将「约 8 月 7 日」视为目标区间而非硬 deadline,在选型与预算规划中为 1–2 周延后留出缓冲。

  3. 03

    以 Grok 4.5 为能力参照锚点:4.5 已有完整模型卡与 15 项基准分数(Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%、定价 $2/$6),用它衡量 4.6 是否值得切换,而非仅凭参数数字。

  4. 04

    横向对比 Kimi K3 与 Fable 5.1 传闻:K3 已在 Frontend Code Arena 以 1679 分登顶、Artificial Analysis 智能指数全球第三;Fable 5.1 传闻指向 8 月发布——三者定位不同,暂无法 head-to-head 对比。

  5. 05

    理解 SFT/RL 升级的实际含义:监督微调用高质量样本纠正输出习惯,强化学习用奖励信号教模型在多步骤 Agent 任务中「怎么做才对」——关注发布后是否延续 4.5 的 token 效率优势(4.5 在 SWE-Bench Pro 上输出约 1.9 万 token,Opus 4.8 约 6.7 万)。

  6. 06

    制定发布窗口内的混合路由策略:按 Grok 4.5 分发路径推测,4.6 大概率先上 Grok Build、xAI API 与 Cursor;在正式定价公布前,保持「常规子任务走 Grok、高精度架构决策留给 Claude」的混合策略,避免过早 All-in 未验证模型。

04

深度拆解:SFT/RL 升级、竞争压力与争议点

SFT 和 RL 到底在解决什么问题?

监督微调(SFT)是用人工标注或精选的高质量样本去纠正模型的输出习惯;强化学习(RL)则是用奖励信号让模型在真实任务链路中学会「怎么做才对」,尤其是多步骤的智能体任务。马斯克特意强调 Grok 4.6 的升级重点在「SFT & RL」而非参数规模本身,这与 Grok 4.5 的打法是延续的——Grok 4.5 当时凭借与 Cursor 合作获取的真实开发者会话数据,在保持较小输出 token 消耗的情况下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成绩,处理同类任务所用的输出 token 数量远低于 Claude Opus 4.8(约 1.9 万 token 对 6.7 万 token)。

为什么 xAI 选择「参数堆量 + 后训练精修」两条腿走路?

Grok 4.6 的 1.5 万亿参数相比 Grok 4.5 是明显的规模跃升,但马斯克没有回避「参数不是唯一变量」这一点——他随后补充说 Grok 4.7 会更大(2.1 万亿)却「推理稍慢」,暗示 xAI 内部很清楚参数规模和推理速度之间存在权衡,未来会用两款不同定位的模型分别满足「更强」和「更快」的需求,而不是用一个模型通吃所有场景。

与 Kimi K3 同期竞争带来的现实压力

Grok 4.6 的发布时间表恰好卡在 Kimi K3 全面开源引发行业震动之后的第 10 天左右。Kimi K3 在 Frontend Code Arena 编程榜单上以 1679 分登顶,成为首个超越所有闭源模型的开源模型,Artificial Analysis 智能指数综合排名全球第三。马斯克本人也在 Kimi K3 相关评测下留言称「令人印象深刻」。业内普遍解读,xAI 加快 Grok 4.6/4.7 发布节奏,与 OpenAI、Anthropic 及中国厂商的竞争烈度上升直接相关。

!

争议点一:时间表未经第三方验证。目前唯一信息源是马斯克在 X 上的一条回复贴,xAI 官方博客和产品页尚未同步公告,实际日期存在提前或推迟的可能。

!

争议点二:基准分数与定价全部空白。与 Grok 4.5 发布时详细的模型卡、基准表不同,Grok 4.6 目前没有任何独立测评或官方模型卡佐证其能力,「1.5 万亿参数」和「SFT/RL 大幅升级」目前都是厂商单方面说法。

背景:xAI 内容安全争议。就在 Grok 4.6 预告前不久,xAI 于 7 月对一名用户提起诉讼,指控其利用 Grok 绕过安全限制生成儿童性虐待材料(CSAM),这也是 xAI 首次就 AI 生成的深度伪造内容起诉用户。今年 1 月,Common Sense Media 的报告曾将 Grok 评为「未成年人保护最差的 AI 产品之一」。这些争议不影响模型本身的技术能力评价,但涉及企业在快速迭代节奏下的安全合规投入,值得关注。

背景:行业「减速」与「加速」的分裂。7 月 28 日——马斯克发布 Grok 4.6/4.7 路线图的同一天,OpenAI、Anthropic 等公司 1200 余名员工联署了「Pacing the Frontier」公开信,呼吁美国政府建立主动放缓前沿 AI 发展的治理工具,OpenAI 和 Anthropic 均以公司名义背书。xAI 并未出现在签署名单中。

05

可引用硬核数据与 2026 年 8 月「扎堆发布月」判断

  • Grok 4.6 参数规模:马斯克预告 1.5 万亿参数,较 Grok 4.5(参数量未公开)是明确的规模跃升,但尚无独立基准佐证。
  • Grok 4.7 跟进节奏:2.1 万亿参数,预计在 4.6 发布后「几周」内上线,马斯克称其「全面优于 4.6,但推理速度略慢,token 效率更高」。
  • Grok 4.5 Token 效率参照:SWE-Bench Pro 任务平均输出约 15,954 token(Grok 4.5)vs 67,020 token(Opus 4.8),差距 4.2 倍——这是判断 4.6 是否延续效率优势的关键指标。
  • Kimi K3 竞争坐标:2.8T MoE(激活约 16/896 专家)、100 万 token 上下文、Frontend Code Arena 1679 分登顶、Artificial Analysis 智能指数全球第三。
  • Claude Fable 5.1 传闻窗口:据 36kr、WinCentral 等多方爆料指向 8 月,且 Anthropic 意图抢在 OpenAI GPT-6 之前上线——尚未被官方确认。
  • 三连发节奏:若时间表成立,xAI 将在约两个月内连续推出 Grok 4.5、4.6、4.7 三款前沿模型,压缩了上一代旗舰的有效货架期。

如果马斯克的时间表成立,Grok 4.6、Grok 4.7 将与传闻中的 Claude Fable 5.1 在同一个月内相继登场,叠加 7 月已经开源的 Kimi K3 带来的开源模型冲击,2026 年 8 月很可能成为大模型发布密度最高的月份之一。对开发者和企业用户而言,这意味着选型窗口期极短——上一代旗舰可能刚上线一个月就要面对新一代竞品,性价比和 token 效率(而非单纯的参数规模或跑分)会是更实际的决策依据。

要在本地跟踪多模型 API 切换、Agent 编排管线或 Grok/Cursor 联合开发工作流,笔记本往往面临进程不稳定、无法 7×24 常驻与编译负载瓶颈;自建 VPS 又常遇 Apple Silicon 生态缺失与 Metal 编译链不可用。对于需要稳定隔离环境、适合 iOS CI/CD 与 AI Agent 自动化的生产场景,VpsMesh 的 Mac Mini M4 云端租赁通常是更优解:统一内存适合大上下文 Agent 编排,远端节点可 7×24 承载多模型路由测试而不污染本机环境。详情可见 Mac Mini M4 租赁定价

FAQ

Grok 4.6 发布常见问题

马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。建议关注 xAI 官方 X 账号与 x.ai 公告。

Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后「几周」跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。xAI 似乎在构建「更快」与「更强」两款 SKU 的分层策略。

目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单上表现突出,Claude Fable 5.1 本身尚未被 Anthropic 官方确认发布,三者暂无法直接对比。可参考本站 Kimi K3 全面开源解析了解竞品现状。

官方未公布。可参考 Grok 4.5 的定价(输入 $2 / 输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整,务必以正式发布信息为准。若需部署 Agent 测试环境评估成本,可查看 帮助中心相关说明。

按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入更多第三方平台(如 Cursor),但具体入口以正式发布公告为准。