AI Agent xAI 2026.07.30

Дата выхода Grok 4.6: Маск анонсировал 7 августа, 1,5T параметров

28 июля Маск ответил в X CEO Vercel Guillermo Rauch: xAI планирует Grok 4.6 с 1,5 триллионом (1,5T) параметров около 7 августа, а через несколько недель — Grok 4.7 с 2,1T параметров. Это всего месяц после Grok 4.5 — xAI намерена выпустить три frontier-модели этим летом. Официальные бенчмарки и цены не опубликованы; ниже — публичные заявления Маска и отраслевые отчёты.

Для лидов по выбору моделей и AI-разработчиков статья раскрывает: ① календарь 4.5→4.6/4.7 и риск «Musk time»; ② усиление SFT/RL и конкурентное давление Kimi K3; ③ поперечное сравнение, контекст споров, шесть шагов подготовки и FAQ. Данные на 30.07.2026, неподтверждённые факты помечены.

01 От Grok 4.5 до 4.6/4.7: темп релизов и ключевые проблемы

Если календарь Маска сработает, xAI выпустит три frontier-модели примерно за два месяца. Ключевые даты:

  • 8 июля 2026: xAI выпускает Grok 4.5 — фокус на coding/agent, co-training с Cursor, контекст 500K токенов, $2/$6 за миллион input/output токенов.
  • 16–26 июля 2026: Kimi K3 Moonshot AI переходит от hosted preview к полному open-weight release (2,8T, 1M токенов).
  • 28 июля 2026: Маск публикует roadmap Grok 4.6/4.7 в ответе Rauch — главный источник этой статьи.
  • ~7 августа 2026 (цель): Grok 4.6, 1,5T, фокус на SFT/RL.
  • Конец августа–начало сентября 2026 (оценка): Grok 4.7, 2,1T, лучше 4.6, но serving немного медленнее.

Ключевые проблемы для разработчиков и предприятий:

  • Единственный источник: подтверждён только пост Маска в X; блог и продуктовая страница xAI не синхронизированы.
  • Пробел в бенчмарках и ценах: в отличие от Grok 4.5, для 4.6 нет независимой оценки.
  • Крайне короткое окно выбора: flagship-модели устаревают за недели — эффективность токенов важнее leaderboard.
  • Риск безопасности и compliance: в июле xAI подала иск пользователю за генерацию CSAM; Common Sense Media в январе оценила Grok как один из худших чатботов для защиты детей.

Календари Маска исторически гибки — индустрия говорит «Musk time». Задержки от дней до двух недель обычны. Перед релизом ориентируйтесь на официальные каналы xAI.

02 Серия Grok: ключевые параметры

Параметры моделей Grok (на 30.07.2026)
Модель Дата/цель Параметры Фокус Статус
Grok 4.3 Beta17 апр. 2026Не раскрытоBaselineВыпущен
Grok 4.58 июл. 2026Не раскрыто (single SKU, не MoE)Coding/agent, co-training CursorВыпущен
Grok 4.6~7 авг. 20261,5TАпгрейд SFT/RLАнонсирован, не выпущен
Grok 4.7~Конец авг.–нач. сент.2,1TЛучше 4.6, выше эффективность токеновАнонсирован, не выпущен

Параметры, цены и бенчмарки — заявления vendor/Маска. Для Grok 4.6/4.7 нет независимой проверки третьей стороной — верифицируйте при официальном релизе.

03 Deep dive: апгрейд — не «больше», а «лучше учится»

Что решают SFT и RL

Supervised Fine-Tuning (SFT) корректирует выходные паттерны на курированных примерах. Reinforcement Learning (RL) учит правильные последовательности действий в многошаговых agent-задачах через reward-сигналы. Маск подчёркивает для Grok 4.6 «significantly improved SFT & RL» вместо чистого scale — продолжение стратегии Grok 4.5: Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %, ~19 000 output-токенов на SWE-Bench Pro task vs ~67 000 у Claude Opus 4.8.

Scale и post-training параллельно

1,5T у Grok 4.6 — реальный скачок над 4.5, но Маск описывает Grok 4.7 (2,1T) как «лучше во всём, кроме немного медленнее serving» — xAI разделяет «сильнее» и «быстрее» в два SKU.

Конкурентное давление Kimi K3

Целевая дата Grok 4.6 — почти ровно 10 дней после open-weight shock Kimi K3. Kimi K3 набрал 1679 очков в Frontend Code Arena — первый open-weight выше всех closed models — и 3-й в Artificial Analysis Intelligence Index. Маск прокомментировал бенчмарки Kimi K3: «impressive». Ускорение 4.6/4.7 xAI коррелирует с усилением конкуренции от OpenAI, Anthropic и китайских лабораторий.

04 Сравнение: Grok vs Kimi K3 и аналоги

Grok и simultaneous flagship-модели
Модель Вендор Параметры Контекст Цена (input/output за 1M токенов) Источник
Grok 4.5xAIНе раскрыто500K токенов$2 / $6xAI официально
Grok 4.6 (анонс)xAI1,5TНе раскрытоНе раскрытоПост Маска в X (не проверено)
Kimi K3Moonshot AI2,8T (MoE, ~16/896 экспертов активны)1M токенов$0,30 (cache hit)/$3 input, $15 outputMoonshot официально
Claude Fable 5.1 (слух)AnthropicНе раскрытоНе раскрытоСлух: цены Fable 5 ($10/$50)36kr, WinCentral — Anthropic не подтвердил
GPT-5.6 SolOpenAIНе раскрытоНе раскрытоНе раскрытоOpenAI официально

Grok 4.6 и Claude Fable 5.1 — анонсы/слухи, не верифицированные head-to-head бенчмарки. Для оценки тайминга и грубого позиционирования.

05 Споры, шесть шагов подготовки и цитируемые данные

На что смотреть перед релизом:

  • Календарь не проверен: единственный источник — пост Маска в X.
  • Бенчмарки и цены пусты: «1,5T» и «SFT/RL upgrade» — пока заявления vendor.
  • Споры безопасности xAI: иск в июле за CSAM; Common Sense Media в январе — Grok среди худших для защиты детей.
  • Расхождение с «Pacing the Frontier»: 28 июля более 1200 сотрудников OpenAI, Anthropic и др. подписали письмо о замедлении frontier AI — xAI не в списке.

Шесть шагов подготовки к Grok 4.6:

  1. Подписаться на официальные каналы xAI: xAI в X и x.ai — не только вторичные источники.
  2. Пересмотреть бенчмарки Grok 4.5: наш обзор Grok 4.5 как baseline для 4.6.
  3. Создать xAI API аккаунт: API Key в консоли, Grok 4.5 для проверки latency и connectivity.
  4. Настроить OpenAI-совместимый клиент: Grok 4.5 в Cursor или custom agent, задокументировать token baseline.
  5. Сравнительный бенчмарк Kimi K3: статья Kimi K3 open-weight, те же agent workflows.
  6. Спланировать dual-SKU routing: Grok 4.6 (быстрый) и 4.7 (качество) до релиза.
grok_api_baseline.py
from openai import OpenAI

client = OpenAI(
    api_key="your_xai_api_key",
    base_url="https://api.x.ai/v1"
)

response = client.chat.completions.create(
    model="grok-4.5",
    messages=[{"role": "user", "content": "Analyze this agent workflow..."}]
)

Цитируемые hard data (xAI официально, Маск X, Moonshot официально, 30.07.2026):

  • Grok 4.6 параметры: 1,5T (официальный анонс, третья сторона не проверила)
  • Grok 4.7 параметры: 2,1T, конец авг.–нач. сент. (официальный анонс)
  • Grok 4.5 цены: input $2/M token, output $6/M token, контекст 500K токенов
  • Grok 4.5 SWE-Bench Pro: 64,7 %; Terminal-Bench 2.1: 83,3 %
  • Эффективность токенов: Grok 4.5 ~19 000 output-токенов/task vs Opus 4.8 ~67 000
  • Kimi K3: 2,8T параметров, 1M токенов, Frontend Code Arena 1679 очков
  • Темп релизов: ~1 месяц от 4.5 до 4.6, три frontier за ~2 месяца

06 FAQ, августовый релиз-раш и production-итог

Когда точно выйдет Grok 4.6?
Маск сказал «около 7 августа 2026» в X — xAI официально не подтвердил. Возможен сдвиг.

Разница между Grok 4.6 и 4.7?
Grok 4.6: 1,5T, фокус post-training SFT/RL. Grok 4.7: 2,1T, через несколько недель, по Маску лучше 4.6 кроме немного медленнее serving, с выше эффективностью токенов.

Grok 4.6 обгонит Kimi K3 или Claude Fable 5.1?
Слишком рано. Нет опубликованных бенчмарков Grok 4.6; Kimi K3 имеет верифицированные scores; Fable 5.1 Anthropic не подтвердил.

Цена Grok 4.6?
Неизвестна. Grok 4.5 при $2/$6 как ориентир — проверьте официальные цены при релизе.

Где использовать Grok 4.6?
Вероятно как Grok 4.5: Grok Build, xAI API, консоль первыми, затем сторонние платформы — для 4.6 не подтверждено.

Если календарь Маска сработает, Grok 4.6/4.7 выйдут в том же месяце, что слуховой Claude Fable 5.1 — прямо после open-weight shock Kimi K3. Август 2026 может стать одним из самых dense месяцев в LLM-релизах.

API-доступ к Grok быстрый, но production-teams платят три скрытые costs: multi-model routing на shared VPS без достаточной RAM, agent pipelines без стабильного 24/7 runner, повторные интеграции при частой смене flagship. Для Grok-агентов, full-repo analysis и MCP-серверов в production multi-region bare-metal Mac nodes JEXCLOUD стабильнее: dedicated Apple Silicon unified memory, без oversubscription jitter, launchd-managed agent gateways, provisioning за 120 секунд. Ноды и тарифы на странице цен JEXCLOUD.