AI Agent xAI 2026.07.30

Date de sortie Grok 4.6 : Musk annonce le 7 août, 1,5T paramètres

Le 28 juillet, Musk a répondu sur X au CEO de Vercel Guillermo Rauch : xAI prévoit Grok 4.6 avec 1,5 trillion (1,5T) de paramètres vers le 7 août, suivi de Grok 4.7 à 2,1T dans quelques semaines. Un mois seulement après Grok 4.5 — xAI vise trois modèles frontier cet été. Aucun benchmark officiel ni prix publié ; les informations ci-dessous viennent des déclarations publiques de Musk et de la presse sectorielle.

Pour les décideurs en sélection de modèles et les développeurs IA, cet article couvre : ① le calendrier 4.5→4.6/4.7 et le risque « Musk time » ; ② le renforcement SFT/RL et la pression concurrentielle de Kimi K3 ; ③ comparaison transversale, contexte des controverses, six étapes de préparation et FAQ. Données au 30 juillet 2026, informations non confirmées signalées.

01 De Grok 4.5 à 4.6/4.7 : rythme de release et points critiques

Si le calendrier de Musk tient, xAI livrera trois modèles frontier en environ deux mois. Dates clés :

  • 8 juillet 2026 : xAI publie Grok 4.5 — focus coding/agent, co-training Cursor, contexte 500K tokens, $2/$6 par million de tokens input/output.
  • 16–26 juillet 2026 : Kimi K3 de Moonshot AI passe du hosted preview au release open-weight complet (2,8T, 1M tokens).
  • 28 juillet 2026 : Musk publie la roadmap Grok 4.6/4.7 en réponse à Rauch — source principale de cet article.
  • ~7 août 2026 (cible) : Grok 4.6, 1,5T, upgrade SFT/RL.
  • Fin août–début septembre 2026 (estimé) : Grok 4.7, 2,1T, meilleur que 4.6 sauf serving légèrement plus lent.

Points critiques pour développeurs et entreprises :

  • Source unique : seul un post X de Musk est confirmé ; blog et page produit xAI non synchronisés.
  • Benchmarks et prix vides : contrairement à Grok 4.5, aucune évaluation indépendante pour 4.6.
  • Fenêtre de choix très courte : les flagship vieillissent en quelques semaines — l'efficacité token prime sur le leaderboard.
  • Risque sécurité et conformité : xAI a poursuivi un utilisateur en juillet pour génération CSAM ; Common Sense Media a classé Grok parmi les pires chatbots IA pour la protection des mineurs en janvier.

Les calendriers de Musk sont historiquement flexibles — le secteur parle de « Musk time ». Des délais de quelques jours à deux semaines sont courants. Avant le release, se fier aux canaux officiels xAI.

02 Série Grok : paramètres clés

Paramètres des modèles Grok (au 30 juillet 2026)
Modèle Date cible Paramètres Focus Statut
Grok 4.3 Beta17 avr. 2026Non publiéBaselinePublié
Grok 4.58 juil. 2026Non publié (SKU unique, non MoE)Coding/agent, co-training CursorPublié
Grok 4.6~7 août 20261,5TUpgrade SFT/RLAnnoncé, non publié
Grok 4.7~Fin août–déb. sept.2,1TSupérieur à 4.6, efficacité tokenAnnoncé, non publié

Paramètres, prix et benchmarks basés sur déclarations vendor/Musk. Aucune évaluation tierce indépendante pour Grok 4.6/4.7 — vérifier au release officiel.

03 Deep dive : l'upgrade vise l'apprentissage, pas seulement la taille

Ce que SFT et RL résolvent

Le fine-tuning supervisé (SFT) corrige les habitudes de sortie avec des exemples curatés. L'apprentissage par renforcement (RL) enseigne les séquences d'actions correctes dans les tâches agent multi-étapes via signaux de récompense. Musk insiste sur « significantly improved SFT & RL » pour Grok 4.6 plutôt que la scale brute — continuité de Grok 4.5 : Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %, ~19 000 tokens output par tâche SWE-Bench Pro vs ~67 000 pour Claude Opus 4.8.

Scale et post-training en parallèle

1,5T pour Grok 4.6 est un vrai saut vs 4.5, mais Musk décrit Grok 4.7 (2,1T) comme « meilleur en tout sauf serving légèrement plus lent » — xAI sépare « plus fort » et « plus rapide » en deux SKUs.

Pression concurrentielle de Kimi K3

La date cible de Grok 4.6 tombe ~10 jours après le shock open-weight de Kimi K3. Kimi K3 a atteint 1 679 points au Frontend Code Arena — premier open-weight au-dessus de tous les closed models — et rang 3 sur l'Intelligence Index d'Artificial Analysis. Musk a commenté les benchmarks Kimi K3 : « impressive ». L'accélération 4.6/4.7 de xAI s'inscrit dans la compétition intensifiée avec OpenAI, Anthropic et les labs chinois.

04 Comparaison : Grok vs Kimi K3 et pairs

Grok et modèles flagship simultanés
Modèle Fournisseur Paramètres Contexte Prix (input/output par 1M tokens) Source
Grok 4.5xAINon publié500K tokens$2 / $6xAI officiel
Grok 4.6 (annoncé)xAI1,5TNon publiéNon publiéPost X de Musk (non vérifié)
Kimi K3Moonshot AI2,8T (MoE, ~16/896 experts actifs)1M tokens$0,30 (cache hit)/$3 input, $15 outputMoonshot officiel
Claude Fable 5.1 (rumeur)AnthropicNon publiéNon publiéRumeur : prix Fable 5 ($10/$50)36kr, WinCentral — Anthropic non confirmé
GPT-5.6 SolOpenAINon publiéNon publiéNon publiéOpenAI officiel

Grok 4.6 et Claude Fable 5.1 sont des annonces/rumeurs — pas de benchmark head-to-head vérifié. Utile pour timing et positionnement approximatif.

05 Controverses, six étapes de préparation et données citables

À noter avant le release :

  • Calendrier non vérifié : seule source = post X de Musk.
  • Benchmarks et prix vides : « 1,5T » et « upgrade SFT/RL » sont des déclarations vendor pour l'instant.
  • Controverses sécurité xAI : poursuite juillet pour génération CSAM ; Common Sense Media janvier — Grok parmi les pires pour protection des mineurs.
  • Divergence avec « Pacing the Frontier » : le 28 juillet, plus de 1 200 employés OpenAI, Anthropic, etc. ont signé une lettre pour ralentir la frontier AI — xAI absent de la liste.

Six étapes de préparation Grok 4.6 :

  1. Suivre les canaux officiels xAI : xAI sur X et x.ai — pas seulement des sources secondaires.
  2. Revoir les benchmarks Grok 4.5 : notre test Grok 4.5 comme baseline 4.6.
  3. Créer un compte API xAI : clé API dans la console, tester Grok 4.5 pour latence et connectivité.
  4. Configurer un client OpenAI-compatible : Grok 4.5 dans Cursor ou agent custom, documenter la baseline token.
  5. Benchmark comparatif Kimi K3 : article Kimi K3 open-weight, mêmes workflows agent.
  6. Planifier le routing dual-SKU : Grok 4.6 (rapide) et 4.7 (qualité) avant le release.
grok_api_baseline.py
from openai import OpenAI

client = OpenAI(
    api_key="your_xai_api_key",
    base_url="https://api.x.ai/v1"
)

response = client.chat.completions.create(
    model="grok-4.5",
    messages=[{"role": "user", "content": "Analyze this agent workflow..."}]
)

Données dures citables (xAI officiel, Musk X, Moonshot officiel, 30 juil. 2026) :

  • Grok 4.6 paramètres : 1,5T (annoncé officiellement, tiers non vérifié)
  • Grok 4.7 paramètres : 2,1T, fin août–déb. sept. (annoncé officiellement)
  • Grok 4.5 prix : input $2/M token, output $6/M token, contexte 500K tokens
  • Grok 4.5 SWE-Bench Pro : 64,7 % ; Terminal-Bench 2.1 : 83,3 %
  • Efficacité token : Grok 4.5 ~19 000 tokens output/tâche vs Opus 4.8 ~67 000
  • Kimi K3 : 2,8T paramètres, 1M tokens, Frontend Code Arena 1 679 points
  • Rythme release : ~1 mois de 4.5 à 4.6, trois frontier en ~2 mois

06 FAQ, ruée des releases d'août et conclusion production

Quand sort exactement Grok 4.6 ?
Musk a dit « vers le 7 août 2026 » sur X — xAI n'a pas confirmé officiellement. Décalage possible.

Différence entre Grok 4.6 et 4.7 ?
Grok 4.6 : 1,5T, focus post-training SFT/RL. Grok 4.7 : 2,1T, quelques semaines après, meilleur que 4.6 sauf serving plus lent, efficacité token supérieure selon Musk.

Grok 4.6 bat Kimi K3 ou Claude Fable 5.1 ?
Trop tôt. Aucun benchmark Grok 4.6 publié ; Kimi K3 a des scores vérifiés ; Fable 5.1 non confirmé par Anthropic.

Prix de Grok 4.6 ?
Inconnu. Grok 4.5 à $2/$6 comme référence — vérifier les prix officiels au release.

Où utiliser Grok 4.6 ?
Probablement comme Grok 4.5 : Grok Build, API xAI, console en premier, puis plateformes tierces — non confirmé pour 4.6.

Si le calendrier de Musk tient, Grok 4.6/4.7 arrivent le même mois que le Claude Fable 5.1 rumoré — juste après le shock open-weight de Kimi K3. Août 2026 pourrait être l'un des mois les plus dense en releases LLM.

L'accès API à Grok est rapide, mais les équipes production paient trois coûts cachés : routing multi-modèles sur VPS partagés sans assez de RAM, pipelines agent sans runner stable 24/7, réintégrations répétées lors des changements de flagship. Pour agents Grok, analyse full-repo et serveurs MCP en production, les nœuds Mac bare-metal multi-région JEXCLOUD offrent plus de stabilité : mémoire unifiée Apple Silicon dédiée, pas de jitter d'oversubscription, gateways agent gérées par launchd, provisioning en 120 secondes. Nœuds et tarifs sur la page tarifs JEXCLOUD.