Grok 4.6 什麼時候發布?馬斯克預告 8 月 7 日上線, 參數升至 1.5 萬億
7 月 28 日,馬斯克在 X 上回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發布參數規模達 1.5 萬億的 Grok 4.6,隨後幾週內還會推出 2.1 萬億參數的 Grok 4.7。這距離上一代 Grok 4.5 發布僅一個月,意味 xAI 今年夏天要連續推出三款前沿模型。官方尚未公布基準分數與定價,以下資訊基於馬斯克公開表態及業界報導整理。
面向模型選型決策者與 AI 開發者,本文將回答三件事:① 從 Grok 4.5 到 4.6/4.7 的節奏與「Musk time」風險;② SFT/RL 後訓練升級與 Kimi K3 同期競爭壓力;③ 橫向規格對比、爭議背景、六步發布前準備與 FAQ。資料截至 2026-07-30,未證實資訊均已標注。
01 從 Grok 4.5 到 4.6、4.7:節奏有多快與核心痛點
若馬斯克時間表成立,xAI 將在約兩個月內連續推出三款前沿模型。關鍵節點如下:
- 2026 年 7 月 8 日:xAI 正式發布 Grok 4.5,定位「專為程式設計與 Agent 任務打造」,與 Cursor 合作、使用真實開發者會話資料訓練,支援 50 萬 token 上下文,定價為每百萬 token 輸入 2 美元/輸出 6 美元。
- 2026 年 7 月 16–26 日:競品月之暗面 Kimi K3 以託管服務上線,隨後全面開放 2.8 萬億參數權重與 100 萬 token 上下文。
- 2026 年 7 月 28 日:馬斯克在回覆 Rauch 的貼文中首次公開 Grok 4.6 和 4.7 路線圖——本文主要資訊來源。
- 約 2026 年 8 月 7 日(目標):Grok 4.6 計劃發布,1.5 萬億參數,重點在 SFT 與 RL 升級。
- 2026 年 8 月末至 9 月初(預估):Grok 4.7 計劃跟進,2.1 萬億參數。
開發者與企業用戶當前面臨的核心痛點:
- 資訊源單一:目前唯一確認來源是馬斯克 X 貼文,xAI 官方部落格與產品頁尚未同步公告。
- 基準與定價空白:與 Grok 4.5 發布時詳盡的模型卡不同,4.6 尚無獨立測評或官方基準佐證。
- 選型窗口極短:旗艦模型可能剛上線一個月就要面對新一代競品,token 效率比單純跑分更關鍵。
- 安全合規風險:xAI 7 月對一名用戶提起 CSAM 相關訴訟,企業法務需納入供應商風險評估。
馬斯克給出的時間表歷來存在彈性——業內常稱「Musk time」,實際發布比預告晚幾天到兩週並不罕見,發布前請以 xAI 官方帳號或官網公告為準。
02 Grok 系列核心參數一覽
| 模型 | 發布/目標時間 | 參數規模 | 定位重點 | 狀態 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026 年 4 月 17 日 | 未公開 | 上一代基線 | 已發布 |
| Grok 4.5 | 2026 年 7 月 8 日 | 未公開(非 MoE 單一 SKU) | 程式設計與 Agent,與 Cursor 聯合訓練 | 已發布 |
| Grok 4.6 | 約 2026 年 8 月 7 日 | 1.5 萬億 | SFT/RL 大幅升級 | 官方預告,未發布 |
| Grok 4.7 | 約 8 月末–9 月初 | 2.1 萬億 | 全面優於 4.6,token 效率更高 | 官方預告,未發布 |
參數規模、定價、基準分數均為廠商/馬斯克自述,Grok 4.6 與 4.7 目前均未有第三方獨立評測數據,表中「官方預告」資訊務必以正式發布為準。
03 深度拆解:升級重點不是「更大」,而是「更會學」
SFT 和 RL 到底在解決什麼問題
監督微調(SFT)是用人工標注或精選的高品質樣本糾正模型輸出習慣;強化學習(RL)則用獎勵信號讓模型在真實任務鏈路中學會正確做法,尤其適用於多步驟 Agent 任務。馬斯克強調 Grok 4.6 升級重點在「SFT & RL」而非參數規模本身,延續 Grok 4.5 打法——4.5 憑藉與 Cursor 合作獲取的真實開發者會話資料,在 Terminal-Bench 2.1 拿到 83.3%、SWE-Bench Pro 64.7%,處理同類任務輸出 token 遠低於 Claude Opus 4.8(約 1.9 萬 token 對 6.7 萬 token)。
參數堆量與後訓練精修兩條路並行
Grok 4.6 的 1.5 萬億參數相對 4.5 是明顯規模躍升,但馬斯克隨後補充 Grok 4.7 更大(2.1 萬億)卻「推理稍慢」,暗示 xAI 內部清楚參數規模與推理速度之間的權衡,未來用兩款不同定位的模型分別滿足「更強」與「更快」的需求。
與 Kimi K3 同期競爭的現實壓力
Grok 4.6 目標發布日恰好卡在 Kimi K3 全面開源約 10 天後。Kimi K3 在 Frontend Code Arena 以 1679 分登頂,成為首個超越所有閉源模型的開源模型,Artificial Analysis 智能指數綜合排名全球第三。馬斯克本人也在 Kimi K3 相關評測下留言稱「令人印象深刻」。業內普遍解讀,xAI 加快 Grok 4.6/4.7 節奏與 OpenAI、Anthropic 及中國廠商競爭烈度上升直接相關。
04 橫向對比:Grok 系列 vs 同期競品
| 模型 | 廠商 | 參數規模 | 上下文 | 定價(輸入/輸出,每百萬 token) | 資料來源 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 未公開 | 50 萬 token | $2 / $6 | xAI 官方公告 |
| Grok 4.6(預告) | xAI | 1.5 萬億 | 未公開 | 未公開 | 馬斯克 X 貼文(未經第三方驗證) |
| Kimi K3 | 月之暗面 | 2.8 萬億(MoE,激活約 16/896 專家) | 100 萬 token | $0.30(快取命中)/$3 輸入,$15 輸出 | Moonshot 官方 |
| Claude Fable 5.1(傳聞) | Anthropic | 未公開 | 未公開 | 傳聞維持 Fable 5($10/$50) | 36kr、WinCentral 爆料,Anthropic 未確認 |
| GPT-5.6 Sol | OpenAI | 未公開 | 未公開 | 未公開 | OpenAI 官方公告 |
表格中 Grok 4.6、Claude Fable 5.1 相關數據均為預告或傳聞,不構成正式基準對比,僅供發布節奏與大致定位參考。
05 爭議點、六步發布前準備與可引用數據
發布前須留意的爭議與細節:
- 時間表未經第三方驗證:唯一資訊源是馬斯克 X 貼文,xAI 官方尚未同步公告。
- 基準與定價全部空白:「1.5 萬億參數」與「SFT/RL 大幅升級」目前均為廠商單方面說法。
- xAI 內容安全爭議:7 月 xAI 起訴一名用戶,指控其利用 Grok 繞過安全限制生成 CSAM;Common Sense Media 1 月報告曾將 Grok 評為未成年人保護最差的 AI 產品之一。
- 與行業「減速」呼籲的錯位:7 月 28 日當天,OpenAI、Anthropic 等 1200 餘名員工聯署「Pacing the Frontier」公開信,xAI 未出現在簽署名單中。
六步 Grok 4.6 發布前準備:
- 訂閱 xAI 官方渠道:關注 xAI 官方 X 帳號與 x.ai 公告頁,避免僅依賴二手轉述。
- 複習 Grok 4.5 基準:閱讀本站 Grok 4.5 深度評測,建立 4.6 對標基線。
- 開通 xAI API 帳號:在 xAI 控制台建立 API Key,以 Grok 4.5 驗證連通性與延遲。
- 配置 OpenAI 相容客戶端:在 Cursor 或自訂 Agent 中接入現有 Grok 4.5 端點,記錄 token 消耗基線。
- 建立 Kimi K3 對照基準:參考 Kimi K3 開放權重評測,用相同 Agent 工作流跑對照測試。
- 規劃雙 SKU 路由策略:預留 Grok 4.6(更快)與 4.7(更強)的分層路由配置,避免發布後臨時改架構。
from openai import OpenAI
client = OpenAI(
api_key="your_xai_api_key",
base_url="https://api.x.ai/v1"
)
response = client.chat.completions.create(
model="grok-4.5",
messages=[{"role": "user", "content": "Analyze this agent workflow..."}]
)
可引用硬核數據(來源:xAI 官方、馬斯克 X 貼文、Moonshot 官方,2026-07-30):
- Grok 4.6 參數:1.5 萬億(官方預告,未經第三方驗證)
- Grok 4.7 參數:2.1 萬億,預計 8 月末–9 月初(官方預告)
- Grok 4.5 定價:輸入 $2/M token、輸出 $6/M token,50 萬 token 上下文
- Grok 4.5 SWE-Bench Pro:64.7%;Terminal-Bench 2.1:83.3%
- Token 效率:Grok 4.5 約 1.9 萬輸出 token/任務 vs Opus 4.8 約 6.7 萬
- Kimi K3 規模:2.8 萬億參數、100 萬 token 上下文、Frontend Code Arena 1679 分
- 發布節奏:4.5 到 4.6 僅隔約一個月,三個前沿模型約兩個月內連續推出
06 常見問題、8 月發布潮與生產環境收束
Q:Grok 4.6 具體是哪天發布?
A:馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期,實際時間可能提前或延後。
Q:Grok 4.6 和 Grok 4.7 有什麼區別?
A:Grok 4.6 為 1.5 萬億參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 萬億參數,預計在 4.6 發布後幾週跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢、token 效率更高。
Q:Grok 4.6 會比 Kimi K3 或 Claude Fable 5.1 更強嗎?
A:目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測數據,Claude Fable 5.1 尚未被 Anthropic 官方確認發布。
Q:Grok 4.6 大概會怎麼定價?
A:官方未公布。可參考 Grok 4.5 的 $2/$6 作為大致區間,但新一代定價可能調整,務必以正式發布資訊為準。
Q:普通用戶屆時能在哪裡用上 Grok 4.6?
A:按 Grok 4.5 分發路徑推測,大概率先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入第三方平台,具體入口以正式公告為準。
若馬斯克時間表成立,Grok 4.6、Grok 4.7 將與傳聞中的 Claude Fable 5.1 在同月登場,疊加 7 月已開源的 Kimi K3 衝擊,2026 年 8 月很可能成為大模型發布密度最高的月份之一。
純 API 調用雖可快速接入 Grok,但生產團隊仍面臨多模型路由在共享 VPS 上記憶體不足、Agent 流水線缺乏 7×24 穩定宿主,以及旗艦模型頻繁換代導致整合反覆重構三大隱性成本。對於需要持續運行 Grok Agent、整庫分析與 MCP Server 的生產環境,JEXCLOUD 多區域裸金屬 Mac是更穩定選擇:獨占 Apple Silicon 統一記憶體、無超賣抖動、launchd 常駐 Agent 閘道,120 秒交付。節點與價格見 JEXCLOUD 定價頁。