Grok 4.6 リリース日:マスクが8月7日頃を予告、 1.5Tパラメータへ拡大
7月28日、マスク氏は X で Vercel CEO の Guillermo Rauch への返信の中で、xAI が8月7日前後に1.5兆(1.5T)パラメータの Grok 4.6 をリリースし、数週間後に2.1Tパラメータの Grok 4.7 も投入すると明らかにしました。これは Grok 4.5 からわずか1か月後の話で、xAI が今夏3つのフロンティアモデルを連続投入する計画を示しています。公式ベンチマークと価格は未発表で、以下はマスク氏の公開発言と業界報道に基づきます。
モデル選定担当者と AI 開発者向けに、本記事では次の3点を解説します:① Grok 4.5 から 4.6/4.7 へのスケジュールと「Musk time」リスク;② SFT/RL 後学習強化と Kimi K3 との同時競争圧力;③ 横断スペック比較、論点背景、六ステップ準備ガイドと FAQ。データは 2026-07-30 時点、未確認情報は明記しています。
01 Grok 4.5 から 4.6・4.7:リリースペースと核心課題
マスク氏のタイムラインが成立すれば、xAI は約2か月で3つのフロンティアモデルを投入します。主要な節目は次のとおりです。
- 2026年7月8日:xAI が Grok 4.5 を正式リリース。Cursor と共同トレーニング、実開発者セッションデータ使用、50万トークンコンテキスト、入力 $2/出力 $6(100万トークンあたり)。
- 2026年7月16–26日:競合 Moonshot AI の Kimi K3 がホストサービスから全面オープンウェイト(2.8T、100万トークン)へ移行。
- 2026年7月28日:マスク氏が Rauch への返信で Grok 4.6/4.7 ロードマップを初公開——本記事の主要情報源。
- 約2026年8月7日(目標):Grok 4.6、1.5T、SFT/RL 強化が焦点。
- 2026年8月末–9月初(見込み):Grok 4.7、2.1T、4.6 より全面優位だが推論やや遅い。
開発者と企業ユーザーが直面する核心課題:
- 情報源の単一性:現時点で確認できる唯一の一次情報はマスク氏の X 投稿。xAI 公式ブログ・製品ページは未同期。
- ベンチマークと価格の空白:Grok 4.5 リリース時の詳細モデルカードと異なり、4.6 には独立評価が存在しません。
- 選定ウィンドウの極小化:旗艦モデルの有効期間が数週間に短縮し、リーダーボードより token 効率が実務上重要になります。
- 安全・コンプライアンスリスク:xAI は7月に CSAM 関連でユーザーを提訴。企業法務はベンダーリスク評価に含める必要があります。
マスク氏のスケジュールは歴史的に柔軟性があります——業界では「Musk time」と呼ばれ、数日から2週間の遅延は珍しくありません。正式発表前は xAI 公式アカウントと公式サイトを基準にしてください。
02 Grok シリーズ核心パラメータ一覧
| モデル | リリース/目標日 | パラメータ規模 | 定位 | 状態 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026年4月17日 | 非公開 | 前世代ベースライン | リリース済み |
| Grok 4.5 | 2026年7月8日 | 非公開(単一 SKU、非 MoE) | コーディング/Agent、Cursor 共同 | リリース済み |
| Grok 4.6 | 約2026年8月7日 | 1.5T | SFT/RL 大幅強化 | 公式予告、未リリース |
| Grok 4.7 | 約8月末–9月初 | 2.1T | 4.6 全面優位、token 効率向上 | 公式予告、未リリース |
パラメータ規模・価格・ベンチマークはベンダー/マスク氏の発言に基づきます。Grok 4.6/4.7 は第三者独立評価がなく、表中の「公式予告」は正式発表で必ず再確認してください。
03 深掘り:アップグレードの焦点は「より大きい」ではなく「より学習できる」
SFT と RL が解決する課題
教師あり微調整(SFT)は高品質サンプルで出力習慣を矯正します。強化学習(RL)は報酬信号で多段階 Agent タスクの正しい行動系列を学習させます。マスク氏は Grok 4.6 の強化点をパラメータ規模ではなく「SFT & RL」と強調し、Grok 4.5 の路線を継承しています。4.5 は Cursor 共同トレーニングにより Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% を達成し、同種タスクの出力 token は Claude Opus 4.8 の約6.7万に対し約1.9万でした。
パラメータ拡大と後学習精修の二本柱
Grok 4.6 の 1.5T は 4.5 に対し明確な規模ジャンプですが、マスク氏は Grok 4.7(2.1T)が「推論やや遅い」と補足し、xAI が規模と速度のトレードオフを認識し、異なる定位の2 SKU で「より強い」と「より速い」を分離する方針を示しています。
Kimi K3 との同時競争圧力
Grok 4.6 の目標日は Kimi K3 全面オープンウェイトから約10日後です。Kimi K3 は Frontend Code Arena で1679点、全クローズドモデルを上回る初のオープンウェイトモデルとなり、Artificial Analysis 智能指数で世界第3位。マスク氏自身も Kimi K3 関連ベンチマーク投稿に「印象的」とコメントしました。xAI が 4.6/4.7 を加速する背景として、OpenAI・Anthropic・中国ベンダーとの競争激化が最も説得力のある説明です。
04 横断比較:Grok シリーズ vs 同期競合
| モデル | ベンダー | パラメータ | コンテキスト | 価格(入力/出力、100万 token) | 出典 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 非公開 | 50万 token | $2 / $6 | xAI 公式 |
| Grok 4.6(予告) | xAI | 1.5T | 非公開 | 非公開 | マスク氏 X 投稿(未検証) |
| Kimi K3 | Moonshot AI | 2.8T(MoE、16/896 専家活性) | 100万 token | $0.30(キャッシュヒット)/$3 入力、$15 出力 | Moonshot 公式 |
| Claude Fable 5.1(噂) | Anthropic | 非公開 | 非公開 | 噂:Fable 5 維持($10/$50) | 36kr、WinCentral、Anthropic 未確認 |
| GPT-5.6 Sol | OpenAI | 非公開 | 非公開 | 非公開 | OpenAI 公式 |
Grok 4.6 と Claude Fable 5.1 の行は予告・噂情報であり、正式ベンチマーク比較には使用できません。リリースタイミングとおおよその定位の参考としてください。
05 論点、六ステップ準備と引用可能データ
リリース前に留意すべき論点:
- スケジュール未検証:唯一の情報源はマスク氏の X 投稿です。
- ベンチマーク・価格が全て空白:「1.5T」と「SFT/RL 大幅強化」は現時点でベンダー一方的な主張です。
- xAI のコンテンツ安全論争:7月に CSAM 生成を巡りユーザーを提訴。Common Sense Media は1月、Grok を児童保護最悪クラスの AI と評価していました。
- 業界「減速」呼びかけとのずれ:7月28日、OpenAI・Anthropic ほか1200名超が「Pacing the Frontier」公開信に署名。xAI は署名者に含まれていません。
Grok 4.6 リリース前の六ステップ準備:
- xAI 公式チャネルを購読:xAI 公式 X と x.ai をフォローし、二次情報のみに依存しない。
- Grok 4.5 ベンチマークを復習:本站 Grok 4.5 徹底レビュー で 4.6 対標基線を確立。
- xAI API アカウント開設:コンソールで API Key を作成し、Grok 4.5 で接続性とレイテンシを検証。
- OpenAI 互換クライアント設定:Cursor または自前 Agent で Grok 4.5 エンドポイントを接続し、token 消費基線を記録。
- Kimi K3 対照ベンチマーク構築:Kimi K3 オープンウェイト解説 を参照し、同一 Agent ワークフローで比較テスト。
- デュアル SKU ルーティング計画:Grok 4.6(高速)と 4.7(高品質)の階層ルーティングを事前設計。
from openai import OpenAI
client = OpenAI(
api_key="your_xai_api_key",
base_url="https://api.x.ai/v1"
)
response = client.chat.completions.create(
model="grok-4.5",
messages=[{"role": "user", "content": "Analyze this agent workflow..."}]
)
引用可能なハードデータ(xAI 公式、マスク氏 X、Moonshot 公式、2026-07-30):
- Grok 4.6 パラメータ:1.5T(公式予告、第三者未検証)
- Grok 4.7 パラメータ:2.1T、8月末–9月初見込み(公式予告)
- Grok 4.5 価格:入力 $2/M token、出力 $6/M token、50万 token コンテキスト
- Grok 4.5 SWE-Bench Pro:64.7%;Terminal-Bench 2.1:83.3%
- Token 効率:Grok 4.5 約1.9万出力 token/タスク vs Opus 4.8 約6.7万
- Kimi K3 規模:2.8T パラメータ、100万 token コンテキスト、Frontend Code Arena 1679点
- リリースペース:4.5 から 4.6 まで約1か月、3フロンティアモデルが約2か月で連続投入
06 FAQ、8月リリースラッシュと本番環境への提言
Q:Grok 4.6 は具体的にいつリリースされますか?
A:マスク氏は「8月7日頃」と述べましたが、xAI 公式確認ではありません。前後する可能性があります。
Q:Grok 4.6 と Grok 4.7 の違いは?
A:Grok 4.6 は 1.5T、SFT/RL 後学習強化が焦点。Grok 4.7 は 2.1T、4.6 数週間後に投入見込みで、マスク氏は全面優位だが推論やや遅く token 効率が高いと述べています。
Q:Grok 4.6 は Kimi K3 や Claude Fable 5.1 より強いですか?
A:現時点では判断不能です。Grok 4.6 に公開ベンチマークはなく、Kimi K3 は実測データあり、Fable 5.1 は Anthropic 未確認です。
Q:Grok 4.6 の価格は?
A:未発表。Grok 4.5 の $2/$6 を参考にできますが、正式情報で必ず確認してください。
Q:一般ユーザーはどこで Grok 4.6 を使えますか?
A:Grok 4.5 の展開経路から、Grok Build、xAI API、コンソールが先行し、第三者プラットフォームが続く見込みですが、4.6 については未確認です。
マスク氏のタイムラインが成立すれば、Grok 4.6/4.7 は噂の Claude Fable 5.1 と同月に登場し、7月オープンウェイト化した Kimi K3 の衝撃と重なり、2026年8月は LLM リリース密度が最も高い月の一つになる可能性があります。
API 経由の Grok 利用は迅速ですが、本番チームは依然として共有 VPS 上でのマルチモデルルーティングによるメモリ不足、Agent パイプラインの 7×24 安定ホスト不足、旗艦モデル頻繁交代による統合の反復再構築という3つの隠れコストに直面します。Grok Agent、リポジトリ全体分析、MCP Server を本番で継続運用するには、JEXCLOUD マルチリージョン裸金属 Mac ノードがより安定した選択です:専有 Apple Silicon 統合メモリ、オーバーサブスクリプションなし、launchd 常駐 Agent ゲートウェイ、120秒プロビジョニング。ノードと料金は JEXCLOUD 料金ページ をご覧ください。