AI Agent xAI 2026.07.30

Grok 4.6 リリース日:マスクが8月7日頃を予告、 1.5Tパラメータへ拡大

7月28日、マスク氏は X で Vercel CEO の Guillermo Rauch への返信の中で、xAI が8月7日前後1.5兆(1.5T)パラメータの Grok 4.6 をリリースし、数週間後に2.1Tパラメータの Grok 4.7 も投入すると明らかにしました。これは Grok 4.5 からわずか1か月後の話で、xAI が今夏3つのフロンティアモデルを連続投入する計画を示しています。公式ベンチマークと価格は未発表で、以下はマスク氏の公開発言と業界報道に基づきます。

モデル選定担当者と AI 開発者向けに、本記事では次の3点を解説します:① Grok 4.5 から 4.6/4.7 へのスケジュールと「Musk time」リスク;② SFT/RL 後学習強化と Kimi K3 との同時競争圧力;③ 横断スペック比較、論点背景、六ステップ準備ガイドと FAQ。データは 2026-07-30 時点、未確認情報は明記しています。

01 Grok 4.5 から 4.6・4.7:リリースペースと核心課題

マスク氏のタイムラインが成立すれば、xAI は約2か月で3つのフロンティアモデルを投入します。主要な節目は次のとおりです。

  • 2026年7月8日:xAI が Grok 4.5 を正式リリース。Cursor と共同トレーニング、実開発者セッションデータ使用、50万トークンコンテキスト、入力 $2/出力 $6(100万トークンあたり)。
  • 2026年7月16–26日:競合 Moonshot AI の Kimi K3 がホストサービスから全面オープンウェイト(2.8T、100万トークン)へ移行。
  • 2026年7月28日:マスク氏が Rauch への返信で Grok 4.6/4.7 ロードマップを初公開——本記事の主要情報源。
  • 約2026年8月7日(目標):Grok 4.6、1.5T、SFT/RL 強化が焦点。
  • 2026年8月末–9月初(見込み):Grok 4.7、2.1T、4.6 より全面優位だが推論やや遅い。

開発者と企業ユーザーが直面する核心課題:

  • 情報源の単一性:現時点で確認できる唯一の一次情報はマスク氏の X 投稿。xAI 公式ブログ・製品ページは未同期。
  • ベンチマークと価格の空白:Grok 4.5 リリース時の詳細モデルカードと異なり、4.6 には独立評価が存在しません。
  • 選定ウィンドウの極小化:旗艦モデルの有効期間が数週間に短縮し、リーダーボードより token 効率が実務上重要になります。
  • 安全・コンプライアンスリスク:xAI は7月に CSAM 関連でユーザーを提訴。企業法務はベンダーリスク評価に含める必要があります。

マスク氏のスケジュールは歴史的に柔軟性があります——業界では「Musk time」と呼ばれ、数日から2週間の遅延は珍しくありません。正式発表前は xAI 公式アカウントと公式サイトを基準にしてください。

02 Grok シリーズ核心パラメータ一覧

Grok シリーズモデルパラメータ対照(2026-07-30 時点)
モデル リリース/目標日 パラメータ規模 定位 状態
Grok 4.3 Beta2026年4月17日非公開前世代ベースラインリリース済み
Grok 4.52026年7月8日非公開(単一 SKU、非 MoE)コーディング/Agent、Cursor 共同リリース済み
Grok 4.6約2026年8月7日1.5TSFT/RL 大幅強化公式予告、未リリース
Grok 4.7約8月末–9月初2.1T4.6 全面優位、token 効率向上公式予告、未リリース

パラメータ規模・価格・ベンチマークはベンダー/マスク氏の発言に基づきます。Grok 4.6/4.7 は第三者独立評価がなく、表中の「公式予告」は正式発表で必ず再確認してください。

03 深掘り:アップグレードの焦点は「より大きい」ではなく「より学習できる」

SFT と RL が解決する課題

教師あり微調整(SFT)は高品質サンプルで出力習慣を矯正します。強化学習(RL)は報酬信号で多段階 Agent タスクの正しい行動系列を学習させます。マスク氏は Grok 4.6 の強化点をパラメータ規模ではなく「SFT & RL」と強調し、Grok 4.5 の路線を継承しています。4.5 は Cursor 共同トレーニングにより Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% を達成し、同種タスクの出力 token は Claude Opus 4.8 の約6.7万に対し約1.9万でした。

パラメータ拡大と後学習精修の二本柱

Grok 4.6 の 1.5T は 4.5 に対し明確な規模ジャンプですが、マスク氏は Grok 4.7(2.1T)が「推論やや遅い」と補足し、xAI が規模と速度のトレードオフを認識し、異なる定位の2 SKU で「より強い」と「より速い」を分離する方針を示しています。

Kimi K3 との同時競争圧力

Grok 4.6 の目標日は Kimi K3 全面オープンウェイトから約10日後です。Kimi K3 は Frontend Code Arena で1679点、全クローズドモデルを上回る初のオープンウェイトモデルとなり、Artificial Analysis 智能指数で世界第3位。マスク氏自身も Kimi K3 関連ベンチマーク投稿に「印象的」とコメントしました。xAI が 4.6/4.7 を加速する背景として、OpenAI・Anthropic・中国ベンダーとの競争激化が最も説得力のある説明です。

04 横断比較:Grok シリーズ vs 同期競合

Grok と同期旗艦モデルのスペック比較
モデル ベンダー パラメータ コンテキスト 価格(入力/出力、100万 token) 出典
Grok 4.5xAI非公開50万 token$2 / $6xAI 公式
Grok 4.6(予告)xAI1.5T非公開非公開マスク氏 X 投稿(未検証)
Kimi K3Moonshot AI2.8T(MoE、16/896 専家活性)100万 token$0.30(キャッシュヒット)/$3 入力、$15 出力Moonshot 公式
Claude Fable 5.1(噂)Anthropic非公開非公開噂:Fable 5 維持($10/$50)36kr、WinCentral、Anthropic 未確認
GPT-5.6 SolOpenAI非公開非公開非公開OpenAI 公式

Grok 4.6 と Claude Fable 5.1 の行は予告・噂情報であり、正式ベンチマーク比較には使用できません。リリースタイミングとおおよその定位の参考としてください。

05 論点、六ステップ準備と引用可能データ

リリース前に留意すべき論点:

  • スケジュール未検証:唯一の情報源はマスク氏の X 投稿です。
  • ベンチマーク・価格が全て空白:「1.5T」と「SFT/RL 大幅強化」は現時点でベンダー一方的な主張です。
  • xAI のコンテンツ安全論争:7月に CSAM 生成を巡りユーザーを提訴。Common Sense Media は1月、Grok を児童保護最悪クラスの AI と評価していました。
  • 業界「減速」呼びかけとのずれ:7月28日、OpenAI・Anthropic ほか1200名超が「Pacing the Frontier」公開信に署名。xAI は署名者に含まれていません。

Grok 4.6 リリース前の六ステップ準備:

  1. xAI 公式チャネルを購読:xAI 公式 X と x.ai をフォローし、二次情報のみに依存しない。
  2. Grok 4.5 ベンチマークを復習:本站 Grok 4.5 徹底レビュー で 4.6 対標基線を確立。
  3. xAI API アカウント開設:コンソールで API Key を作成し、Grok 4.5 で接続性とレイテンシを検証。
  4. OpenAI 互換クライアント設定:Cursor または自前 Agent で Grok 4.5 エンドポイントを接続し、token 消費基線を記録。
  5. Kimi K3 対照ベンチマーク構築Kimi K3 オープンウェイト解説 を参照し、同一 Agent ワークフローで比較テスト。
  6. デュアル SKU ルーティング計画:Grok 4.6(高速)と 4.7(高品質)の階層ルーティングを事前設計。
grok_api_baseline.py
from openai import OpenAI

client = OpenAI(
    api_key="your_xai_api_key",
    base_url="https://api.x.ai/v1"
)

response = client.chat.completions.create(
    model="grok-4.5",
    messages=[{"role": "user", "content": "Analyze this agent workflow..."}]
)

引用可能なハードデータ(xAI 公式、マスク氏 X、Moonshot 公式、2026-07-30):

  • Grok 4.6 パラメータ:1.5T(公式予告、第三者未検証)
  • Grok 4.7 パラメータ:2.1T、8月末–9月初見込み(公式予告)
  • Grok 4.5 価格:入力 $2/M token、出力 $6/M token、50万 token コンテキスト
  • Grok 4.5 SWE-Bench Pro:64.7%;Terminal-Bench 2.1:83.3%
  • Token 効率:Grok 4.5 約1.9万出力 token/タスク vs Opus 4.8 約6.7万
  • Kimi K3 規模:2.8T パラメータ、100万 token コンテキスト、Frontend Code Arena 1679点
  • リリースペース:4.5 から 4.6 まで約1か月、3フロンティアモデルが約2か月で連続投入

06 FAQ、8月リリースラッシュと本番環境への提言

Q:Grok 4.6 は具体的にいつリリースされますか?
A:マスク氏は「8月7日頃」と述べましたが、xAI 公式確認ではありません。前後する可能性があります。

Q:Grok 4.6 と Grok 4.7 の違いは?
A:Grok 4.6 は 1.5T、SFT/RL 後学習強化が焦点。Grok 4.7 は 2.1T、4.6 数週間後に投入見込みで、マスク氏は全面優位だが推論やや遅く token 効率が高いと述べています。

Q:Grok 4.6 は Kimi K3 や Claude Fable 5.1 より強いですか?
A:現時点では判断不能です。Grok 4.6 に公開ベンチマークはなく、Kimi K3 は実測データあり、Fable 5.1 は Anthropic 未確認です。

Q:Grok 4.6 の価格は?
A:未発表。Grok 4.5 の $2/$6 を参考にできますが、正式情報で必ず確認してください。

Q:一般ユーザーはどこで Grok 4.6 を使えますか?
A:Grok 4.5 の展開経路から、Grok Build、xAI API、コンソールが先行し、第三者プラットフォームが続く見込みですが、4.6 については未確認です。

マスク氏のタイムラインが成立すれば、Grok 4.6/4.7 は噂の Claude Fable 5.1 と同月に登場し、7月オープンウェイト化した Kimi K3 の衝撃と重なり、2026年8月は LLM リリース密度が最も高い月の一つになる可能性があります。

API 経由の Grok 利用は迅速ですが、本番チームは依然として共有 VPS 上でのマルチモデルルーティングによるメモリ不足Agent パイプラインの 7×24 安定ホスト不足旗艦モデル頻繁交代による統合の反復再構築という3つの隠れコストに直面します。Grok Agent、リポジトリ全体分析、MCP Server を本番で継続運用するには、JEXCLOUD マルチリージョン裸金属 Mac ノードがより安定した選択です:専有 Apple Silicon 統合メモリ、オーバーサブスクリプションなし、launchd 常駐 Agent ゲートウェイ、120秒プロビジョニング。ノードと料金は JEXCLOUD 料金ページ をご覧ください。