AI Agent 2026.07.30

Grok 4.6什么时候发布?马斯克预告8月7日上线,参数升至1.5万亿

马斯克 7 月 28 日在 X 上回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布参数规模达 1.5 万亿Grok 4.6,随后几周内还会推出 2.1 万亿参数的 Grok 4.7。这距离上一代 Grok 4.5 发布仅一个月,意味着 xAI 在今年夏天要连续推出三款前沿模型。

面向模型选型决策者与 AI 开发者,本文将回答三件事:① 从 Grok 4.5 到 4.6/4.7 的完整时间线与「Musk time」弹性;② 1.5T 参数与 SFT/RL 后训练升级的技术含义;③ 与 Kimi K3、Claude Fable 5.1 传闻等竞品的横向对比、争议点与发布前六步准备清单。官方尚未公布基准分数和定价,以下信息基于马斯克公开表态及行业报道整理,未证实部分已标注。

01 从 Grok 4.5 到 4.6/4.7:时间线有多快

  • 2026 年 7 月 8 日:xAI 正式发布 Grok 4.5,定位为「专为编程与智能体任务打造」的旗舰模型,与 Cursor 合作、使用真实开发者会话数据训练,支持 50 万 token 上下文,定价为每百万 token 输入 2 美元/输出 6 美元。
  • 2026 年 7 月 16 日:竞品 Moonshot AI 的 Kimi K3 以托管服务形式上线,随后在 7 月 26 日提前一天放出完整开源权重,2.8 万亿参数、100 万 token 上下文。
  • 2026 年 7 月 28 日:马斯克在回复 Rauch 的帖子中首次公开 Grok 4.6 和 4.7 的路线图与大致时间表——这也是本文信息的主要来源。同一天,OpenAI、Anthropic 等公司 1200 余名员工联署「Pacing the Frontier」公开信,呼吁建立主动放缓前沿 AI 发展的治理工具。
  • 2026 年 8 月 7 日前后(目标):Grok 4.6 计划发布,1.5 万亿参数,重点在 SFT 与 RL 层面的升级,而非单纯堆参数。
  • 2026 年 8 月末至 9 月初(预估):Grok 4.7 计划跟进,2.1 万亿参数,马斯克称其「除了推理速度稍慢外,其他方面全面优于 4.6,且 token 效率更高」。

开发者与企业用户当前面临的核心痛点:

  • 时间表未经官方确认:目前唯一信息源是马斯克在 X 上的一条回复贴,xAI 官方博客和产品页尚未同步公告。
  • 「Musk time」弹性:业内常称马斯克预告日期存在数天到两周的偏差,实际发布可能提前或推迟。
  • 基准与定价空白:与 Grok 4.5 发布时详细的模型卡不同,Grok 4.6 目前没有任何独立测评或官方模型卡佐证其能力。
  • 竞品节奏极快:Kimi K3 全面开源仅 10 天后即迎来 Grok 4.6 预告,选型窗口被大幅压缩。
  • 安全合规背景复杂:xAI 7 月对一名用户提起 CSAM 相关诉讼,Common Sense Media 曾将 Grok 评为未成年人保护最差的 AI 产品之一。

马斯克给出的时间表历来存在弹性——发布前建议以 xAI 官方账号或官网公告为准,勿将一条 X 回复当作正式产品承诺。

02 Grok 系列核心数据一览

Grok 系列模型时间线与参数(截至 2026-07-30)
模型 发布/目标时间 参数规模 定位重点 状态
Grok 4.3 Beta2026 年 4 月 17 日未公开上一代基线已发布
Grok 4.52026 年 7 月 8 日未公开(非 MoE 单一 SKU)编程与智能体,与 Cursor 联合训练已发布
Grok 4.6约 2026 年 8 月 7 日1.5 万亿SFT/RL 大幅升级官方预告,未发布
Grok 4.7约 2026 年 8 月末–9 月初2.1 万亿全面优于 4.6,token 效率更高官方预告,未发布

参数规模、定价、基准分数均为厂商/马斯克自述,Grok 4.6 与 4.7 目前均未有第三方独立评测数据,表中「官方预告」信息务必以正式发布为准。

03 深度拆解:这次升级的重点不是「更大」,而是「更会学」

SFT 和 RL 到底在解决什么问题

监督微调(SFT)是用人工标注或精选的高质量样本去纠正模型的输出习惯;强化学习(RL)则是用奖励信号让模型在真实任务链路中学会「怎么做才对」,尤其是多步骤的智能体任务。马斯克特意强调 Grok 4.6 的升级重点在「SFT & RL」而非参数规模本身,这与 Grok 4.5 的打法是延续的——Grok 4.5 当时凭借与 Cursor 合作获取的真实开发者会话数据,在保持较小输出 token 消耗的情况下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成绩,处理同类任务所用的输出 token 数量远低于 Claude Opus 4.8(约 1.9 万 token 对 6.7 万 token)。

为什么 xAI 选择「参数堆量 + 后训练精修」两条腿走路

Grok 4.6 的 1.5 万亿参数相比 Grok 4.5 是明显的规模跃升,但马斯克没有回避「参数不是唯一变量」这一点——他随后补充说 Grok 4.7 会更大(2.1 万亿)却「推理稍慢」,暗示 xAI 内部很清楚参数规模和推理速度之间存在权衡,未来会用两款不同定位的模型分别满足「更强」和「更快」的需求。

与 Kimi K3 同期竞争带来的现实压力

Grok 4.6 的发布时间表恰好卡在 Kimi K3 全面开源引发行业震动之后的第 10 天左右。Kimi K3 在 Frontend Code Arena 编程榜单上以 1679 分登顶,成为首个超越所有闭源模型的开源模型,Artificial Analysis 智能指数综合排名全球第三。马斯克本人也在 Kimi K3 相关评测下留言称「令人印象深刻」。业内普遍解读,xAI 加快 Grok 4.6/4.7 发布节奏,与 OpenAI、Anthropic 及中国厂商的竞争烈度上升直接相关。

04 横向对比:Grok 系列 vs 同期竞品

Grok 4.6 与同期竞品参数与定价对比
模型 厂商 参数规模 上下文窗口 定价(输入/输出,每百万 token) 数据来源
Grok 4.5xAI未公开50 万 token$2 / $6xAI 官方公告
Grok 4.6(预告)xAI1.5 万亿未公开未公开马斯克 X 帖子(未经第三方验证)
Kimi K3月之暗面2.8 万亿(MoE,激活约 16/896 专家)100 万 token$0.30(缓存命中)/$3(缓存未命中)输入,$15 输出Moonshot 官方 + Hugging Face
Claude Fable 5.1(传闻)Anthropic未公开未公开传闻维持 Fable 5 定价($10 输入/$50 输出)36kr、WinCentral 爆料,Anthropic 未确认
GPT-5.6 SolOpenAI未公开未公开未公开OpenAI 官方公告

表格中 Grok 4.6、Claude Fable 5.1 相关数据均为预告或传闻,不构成正式基准对比,仅供参考发布节奏和大致定位。

05 争议点、六步发布前准备与可引用数据

需要关注的争议与细节:

  • 时间表本身未经第三方验证:xAI 官方博客和产品页尚未同步公告,实际日期存在提前或推迟的可能。
  • 基准分数与定价全部空白:「1.5 万亿参数」和「SFT/RL 大幅升级」目前都是厂商单方面说法。
  • xAI 内容安全争议:xAI 于 7 月对一名用户提起诉讼,指控其利用 Grok 绕过安全限制生成 CSAM,这也是 xAI 首次就 AI 生成的深度伪造内容起诉用户。
  • 与行业「减速」呼吁的错位:7 月 28 日马斯克发布路线图同一天,OpenAI 和 Anthropic 均以公司名义背书「Pacing the Frontier」公开信,xAI 并未出现在签署名单中。

六步 Grok 4.6 发布前准备清单:

  1. 锁定官方信息渠道:关注 xAI 官方博客(x.ai/news)、X 账号 @xai 与 Grok Build 控制台公告,勿仅依赖二手报道。
  2. 建立 Grok 4.5 成本基线:记录当前 API 月用量、每任务 token 消耗与 SWE-Bench 类任务的实际美元成本,便于 4.6 发布后对比。
  3. 预备 Cursor / IDE 切换配置:Grok 4.5 已在 Cursor 首发,4.6 大概率沿用相同路径;提前在设置中预留模型切换与 A/B 测试槽位。
  4. 跟踪同期竞品基准更新:同步关注 Kimi K3、Claude Fable 5.1 传闻与 GPT-5.6 系列的独立复测,避免单点选型。
  5. 评估 Agent 工作流影响:若团队依赖多步骤 coding Agent,重点测试 SFT/RL 升级对长链路任务成功率与 token 效率的改善幅度。
  6. 预留 8 月中下旬预算缓冲:Grok 4.7 预计在 4.6 后数周跟进,两代模型可能短期内并存,算力与 API 预算需留弹性。

可引用硬核数据(来源:xAI 官方、马斯克 X 帖子、Moonshot 官方,2026-07-30):

  • Grok 4.6 目标发布:约 2026 年 8 月 7 日,1.5 万亿参数(马斯克 X 回复,未官方确认)
  • Grok 4.7 预估:2.1 万亿参数,8 月末至 9 月初,推理稍慢但 token 效率更高
  • Grok 4.5 定价:输入 $2/输出 $6 每百万 token,50 万 token 上下文
  • Grok 4.5 Token 效率:SWE-Bench Pro 任务约 1.9 万输出 token,Claude Opus 4.8 约 6.7 万
  • Kimi K3 Frontend Code Arena:1679 分登顶,首个超越所有闭源模型的开源模型
  • Kimi K3 参数规模:2.8 万亿 MoE,100 万 token 上下文
  • 行业背景:7 月 28 日 1200+ 员工联署「Pacing the Frontier」公开信,xAI 未签署

06 常见问题、8 月发布潮背景与生产环境收束

Q1:Grok 4.6 具体是哪天发布?
A:马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。

Q2:Grok 4.6 和 Grok 4.7 有什么区别?
A:Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后「几周」跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。

Q3:Grok 4.6 会比 Kimi K3 或 Claude Fable 5.1 更强吗?
A:目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单上表现突出,Claude Fable 5.1 本身尚未被 Anthropic 官方确认发布。

Q4:Grok 4.6 大概会怎么定价?
A:官方未公布。可参考 Grok 4.5 的定价(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整。

Q5:普通用户届时能在哪里用上 Grok 4.6?
A:按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入更多第三方平台。

如果马斯克的时间表成立,Grok 4.6、Grok 4.7 将与传闻中的 Claude Fable 5.1(据 36kr、WinCentral 等多方爆料指向 8 月)在同一个月内相继登场,叠加 7 月已经开源的 Kimi K3 带来的冲击,2026 年 8 月很可能成为大模型发布密度最高的月份之一。对开发者和企业用户而言,选型窗口期极短——上一代旗舰可能刚上线一个月就要面对新一代竞品,token 效率(而非单纯的参数规模或跑分)会是更实际的决策依据。

纯 API 调用虽可快速试用新模型,但面临共享 VPS 上长连接 Agent 被超卖打断多轮 coding 流水线缺乏 7×24 稳定宿主,以及宽带抖动导致 Cursor 远程会话断连三大隐性成本。对于需要持续运行 Grok/Cursor 类编程 Agent、整库分析与 MCP Server 的生产环境,JEXCLOUD 多区域裸金属 Mac是更优解:独占 Apple Silicon 统一内存、无超卖抖动、launchd 常驻 Agent 网关,120 秒交付。节点与价格见 JEXCLOUD 定价页