Grok 4.6 什么时候发布?
马斯克预告 8 月 7 日上线,参数升至 1.5 万亿

马斯克 7 月 28 日在 X 上回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7。本文面向关注大模型发布节奏编程 Agent 选型的开发者,完整覆盖:Grok 4.5→4.6→4.7 时间线核心参数与竞品对比表SFT/RL 后训练升级解析四大争议点2026 年 8 月扎堆发布背景六步发布前评估清单FAQ。核心提醒:目前信息均来自马斯克单条 X 回复,尚无官方模型卡或第三方基准,发布前务必以 xAI 官方渠道核实。

01

从 Grok 4.5 到 4.6、4.7:xAI 今年夏天要连推三款前沿模型,节奏有多快?

距离上一代 Grok 4.5 发布仅一个月,xAI 就预告了两款更大模型——这对正在评估 Cursor/Grok 编程工作流的团队意味着极短的选型窗口期。以下时间线梳理已确认事件与官方预告。

日期事件
2026-07-08xAI 正式发布 Grok 4.5,定位为编程与智能体旗舰,与 Cursor 合作、使用真实开发者会话数据训练,50 万 token 上下文,定价 $2/$6 每百万 token
2026-07-16月之暗面 Kimi K3 以托管服务形式上线
2026-07-26Kimi K3 提前一天放出完整开源权重,2.8 万亿参数、100 万 token 上下文
2026-07-28马斯克在回复 @rauchg 的帖子中首次公开 Grok 4.6/4.7 路线图——本文主要信息来源
约 2026-08-07Grok 4.6 计划发布,1.5 万亿参数,重点 SFT/RL 升级
约 2026-08 末–9 月初Grok 4.7 计划跟进,2.1 万亿参数,马斯克称其全面优于 4.6 但推理稍慢、token 效率更高

开发者最该警惕的三个「信息陷阱」

  1. 01

    把推文当官方公告:马斯克时间表历来存在弹性(业内称「Musk time」),实际可能晚几天到两周

  2. 02

    参数规模≠能力:4.6 强调 SFT/RL 而非单纯堆参数,4.7 更大却更慢——两款 SKU 定位不同

  3. 03

    竞品窗口极短:Kimi K3 开源冲击后仅约 10 天即预告 Grok 4.6,8 月还可能撞上 Claude Fable 5.1 传闻

  4. 04

    基准分数空白:与 Grok 4.5 发布时详细模型卡不同,4.6 目前零独立测评

  5. 05

    定价未公布:只能参考 4.5 的 $2/$6,新一代可能调整

  6. 06

    安全合规背景:xAI 7 月就 CSAM 深度伪造起诉用户,企业选型须纳入供应商风险评估

warning

Musk time 提醒:马斯克给出的时间表历来存在弹性,实际发布日期比预告晚几天到两周并不罕见。发布前建议以 xAI 官方账号或官网公告为准,勿将本文当作正式规格承诺。

02

Grok 系列核心数据与横向竞品对比:哪些能信、哪些还不能?

Grok 系列演进一览

模型发布/目标时间参数规模定位重点状态
Grok 4.3 Beta2026-04-17未公开上一代基线已发布
Grok 4.52026-07-08未公开(非 MoE 单一 SKU)编程与智能体,与 Cursor 联合训练已发布
Grok 4.6约 2026-08-071.5 万亿SFT/RL 大幅升级官方预告,未发布
Grok 4.7约 2026-08 末–9 月初2.1 万亿全面优于 4.6,token 效率更高官方预告,未发布

注:参数规模、定价、基准分数均为厂商/马斯克自述,Grok 4.6 与 4.7 目前均未有第三方独立评测数据。

同期竞品横向对比

模型厂商参数规模上下文定价(输入/输出,每百万 token)数据来源
Grok 4.5xAI未公开50 万 token$2 / $6xAI 官方
Grok 4.6(预告)xAI1.5 万亿未公开未公开马斯克 X 帖子(未经第三方验证)
Kimi K3月之暗面2.8 万亿(MoE,激活约 16/896 专家)100 万 token$0.30(缓存命中)/$3 输入,$15 输出Moonshot + Hugging Face
Claude Fable 5.1(传闻)Anthropic未公开未公开传闻维持 Fable 5($10/$50)36kr、WinCentral 爆料,未确认
GPT-5.6 SolOpenAI未公开未公开未公开OpenAI 官方

表格中 Grok 4.6、Claude Fable 5.1 相关数据均为预告或传闻,不构成正式基准对比——对开发者而言,token 效率与真实任务成本比参数规模更值得跟踪。

03

这次升级的重点不是「更大」,而是「更会学」:SFT 与 RL 到底在解决什么?

SFT 和 RL 在 Grok 4.6 中的角色

监督微调(SFT)用人工标注或精选高质量样本纠正模型输出习惯;强化学习(RL)用奖励信号让模型在真实任务链路中学会「怎么做才对」,尤其是多步骤智能体任务。马斯克特意强调 Grok 4.6 升级重点在「SFT & RL」而非参数规模本身,这与 Grok 4.5 打法延续——4.5 凭借与 Cursor 合作获取的真实开发者会话数据,在保持较小输出 token 消耗的情况下拿到 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%,处理同类任务输出 token 约 1.9 万,远低于 Claude Opus 4.8 的约 6.7 万

为什么 xAI 选择「参数堆量 + 后训练精修」两条腿走路

Grok 4.6 的 1.5 万亿参数相比 4.5 是明显规模跃升,但马斯克没有回避「参数不是唯一变量」——他随后补充 Grok 4.7 会更大(2.1 万亿)却「推理稍慢」,暗示 xAI 内部清楚参数规模与推理速度之间存在权衡,未来用两款不同定位模型分别满足「更强」和「更快」,而非一个模型通吃所有场景。

与 Kimi K3 同期竞争带来的现实压力

Grok 4.6 发布时间表卡在 Kimi K3 全面开源引发行业震动后约第 10 天。Kimi K3 在 Frontend Code Arena 编程榜单以 1679 分登顶,成为首个超越所有闭源模型的开源模型,Artificial Analysis 智能指数综合排名全球第三。马斯克本人也在 Kimi K3 相关评测下留言称「令人印象深刻」。业内普遍解读,xAI 加快 Grok 4.6/4.7 发布节奏,与 OpenAI、Anthropic 及中国厂商竞争烈度上升直接相关。

发布前六步评估清单(落地操作)

  1. 01

    锁定信息源:关注 xAI 官方博客(x.ai/news)与 @xai 账号,勿仅凭二手媒体报道做采购决策

  2. 02

    建立基准对照:记录当前 Grok 4.5 在你团队真实任务上的 token 消耗与通过率,作为 4.6 上线后的 A/B 基线

  3. 03

    预留预算缓冲:按 4.5 定价 $2/$6 估算上限,同时准备 Kimi K3、GPT-5.6 Sol 等备选路由

  4. 04

    区分 4.6 vs 4.7:延迟敏感场景优先等 4.6;追求极致能力且可接受更慢推理的可观望 4.7

  5. 05

    审查合规风险:评估 xAI 近期 CSAM 诉讼与 Common Sense Media 未成年人保护评级对企业政策的影响

  6. 06

    准备接入路径:按 Grok 4.5 经验,优先检查 Grok Build、xAI API 与 Cursor 等第三方平台的 day-one 公告

04

争议点与需要注意的细节:单一信息源、安全诉讼与行业「减速」呼吁

  • 时间表未经第三方验证:目前唯一信息源是马斯克在 X 上的一条回复,xAI 官方博客和产品页尚未同步公告
  • 基准分数与定价全部空白:与 Grok 4.5 发布时详细模型卡不同,4.6 目前没有任何独立测评佐证,「1.5 万亿参数」和「SFT/RL 大幅升级」均为厂商单方面说法
  • xAI 内容安全争议:7 月 xAI 起诉一名用户利用 Grok 绕过安全限制生成 CSAM,系公司首次就 AI 生成深度伪造内容起诉用户;今年 1 月 Common Sense Media 报告将 Grok 评为「未成年人保护最差的 AI 产品之一」
  • 与行业「减速」呼吁的错位:7 月 28 日——马斯克发布 Grok 4.6/4.7 路线图同一天,OpenAI、Anthropic 等公司 1200 余名员工联署「Pacing the Frontier」公开信,呼吁美国政府建立主动放缓前沿 AI 发展的治理工具;xAI 未出现在签署名单中
info

行业分裂背景:一边呼吁减速、一边压缩发布节奏——2026 年 8 月很可能成为大模型发布密度最高的月份之一。对团队而言,性价比和 token 效率比单纯参数规模或跑分更是实际决策依据。

05

2026 年 8 月会是「扎堆发布月」:可引用数据与对开发者的影响

如果马斯克时间表成立,Grok 4.6、Grok 4.7 将与传闻中的 Claude Fable 5.1(据 36kr、WinCentral 等多方爆料指向 8 月,且 Anthropic 意图抢在 OpenAI GPT-6 之前上线)在同一个月内相继登场,叠加 7 月已开源的 Kimi K3 冲击,2026 年 8 月选型窗口期极短——上一代旗舰可能刚上线一个月就要面对新一代竞品。

可引用关键数据速查

  • Grok 4.6 预告:约 8 月 7 日、1.5 万亿参数、SFT/RL 重点升级(马斯克 X 回复 @rauchg,未独立验证)
  • Grok 4.7 预告:约 8 月末–9 月初、2.1 万亿参数、全面优于 4.6 但推理稍慢、token 效率更高
  • Grok 4.5 已发布基准:Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%;输出 token 约 1.9 万/任务 vs Opus 4.8 约 6.7 万
  • Kimi K3 对照:2.8T 参数、Frontend Code Arena 1679 分、AA Index 全球第三
  • Grok 4.5 定价参考:输入 $2/输出 $6 每百万 token,50 万 token 上下文

若你计划将 Grok 4.6 接入 Cursor 类长会话编码 Agent 或 iOS CI 流水线,在笔记本或不稳定 Linux VPS上跑 CLI Agent 常面临内存不足、会话中断与 Xcode/Metal 工具链缺失。对于需要稳定 SSH 长会话、DerivedData 缓存与 iOS CI/CD 自动化的生产环境,NodeMini 的 Mac Mini 云端租赁通常是更优解——独占节点、秒级拨备,让 Agent 与构建任务在同一台真实 Mac 上持续运行。详见 Mac Mini 租赁价格

以上信息截至 2026 年 7 月 30 日。数据来源:xAI Grok 4.5 官方公告与模型卡、马斯克 2026-07-28 X 帖子、Moonshot Kimi K3 官方发布、36kr/WinCentral 关于 Claude Fable 5.1 传闻、The Verge/TechTimes 关于 Pacing the Frontier 公开信、Ars Technica/TechCrunch 关于 xAI 安全争议报道。

FAQ

常见问题

马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。上线后接入环境可参考 Mac Mini 租赁价格

Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后「几周」跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。

目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单上表现突出,Claude Fable 5.1 本身尚未被 Anthropic 官方确认发布,三者暂无法直接对比。

官方未公布。可参考 Grok 4.5 的定价(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整,务必以正式发布信息为准。

按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入更多第三方平台。更多运维问题见 帮助中心