Date de sortie Grok 4.6 : Musk annonce le 7 août, 1,5T paramètres
Le 28 juillet, Musk a répondu sur X au CEO de Vercel Guillermo Rauch : xAI prévoit Grok 4.6 avec 1,5 trillion (1,5T) de paramètres vers le 7 août, suivi de Grok 4.7 à 2,1T dans quelques semaines. Un mois seulement après Grok 4.5 — xAI vise trois modèles frontier cet été. Aucun benchmark officiel ni prix publié ; les informations ci-dessous viennent des déclarations publiques de Musk et de la presse sectorielle.
Pour les décideurs en sélection de modèles et les développeurs IA, cet article couvre : ① le calendrier 4.5→4.6/4.7 et le risque « Musk time » ; ② le renforcement SFT/RL et la pression concurrentielle de Kimi K3 ; ③ comparaison transversale, contexte des controverses, six étapes de préparation et FAQ. Données au 30 juillet 2026, informations non confirmées signalées.
01 De Grok 4.5 à 4.6/4.7 : rythme de release et points critiques
Si le calendrier de Musk tient, xAI livrera trois modèles frontier en environ deux mois. Dates clés :
- 8 juillet 2026 : xAI publie Grok 4.5 — focus coding/agent, co-training Cursor, contexte 500K tokens, $2/$6 par million de tokens input/output.
- 16–26 juillet 2026 : Kimi K3 de Moonshot AI passe du hosted preview au release open-weight complet (2,8T, 1M tokens).
- 28 juillet 2026 : Musk publie la roadmap Grok 4.6/4.7 en réponse à Rauch — source principale de cet article.
- ~7 août 2026 (cible) : Grok 4.6, 1,5T, upgrade SFT/RL.
- Fin août–début septembre 2026 (estimé) : Grok 4.7, 2,1T, meilleur que 4.6 sauf serving légèrement plus lent.
Points critiques pour développeurs et entreprises :
- Source unique : seul un post X de Musk est confirmé ; blog et page produit xAI non synchronisés.
- Benchmarks et prix vides : contrairement à Grok 4.5, aucune évaluation indépendante pour 4.6.
- Fenêtre de choix très courte : les flagship vieillissent en quelques semaines — l'efficacité token prime sur le leaderboard.
- Risque sécurité et conformité : xAI a poursuivi un utilisateur en juillet pour génération CSAM ; Common Sense Media a classé Grok parmi les pires chatbots IA pour la protection des mineurs en janvier.
Les calendriers de Musk sont historiquement flexibles — le secteur parle de « Musk time ». Des délais de quelques jours à deux semaines sont courants. Avant le release, se fier aux canaux officiels xAI.
02 Série Grok : paramètres clés
| Modèle | Date cible | Paramètres | Focus | Statut |
|---|---|---|---|---|
| Grok 4.3 Beta | 17 avr. 2026 | Non publié | Baseline | Publié |
| Grok 4.5 | 8 juil. 2026 | Non publié (SKU unique, non MoE) | Coding/agent, co-training Cursor | Publié |
| Grok 4.6 | ~7 août 2026 | 1,5T | Upgrade SFT/RL | Annoncé, non publié |
| Grok 4.7 | ~Fin août–déb. sept. | 2,1T | Supérieur à 4.6, efficacité token | Annoncé, non publié |
Paramètres, prix et benchmarks basés sur déclarations vendor/Musk. Aucune évaluation tierce indépendante pour Grok 4.6/4.7 — vérifier au release officiel.
03 Deep dive : l'upgrade vise l'apprentissage, pas seulement la taille
Ce que SFT et RL résolvent
Le fine-tuning supervisé (SFT) corrige les habitudes de sortie avec des exemples curatés. L'apprentissage par renforcement (RL) enseigne les séquences d'actions correctes dans les tâches agent multi-étapes via signaux de récompense. Musk insiste sur « significantly improved SFT & RL » pour Grok 4.6 plutôt que la scale brute — continuité de Grok 4.5 : Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %, ~19 000 tokens output par tâche SWE-Bench Pro vs ~67 000 pour Claude Opus 4.8.
Scale et post-training en parallèle
1,5T pour Grok 4.6 est un vrai saut vs 4.5, mais Musk décrit Grok 4.7 (2,1T) comme « meilleur en tout sauf serving légèrement plus lent » — xAI sépare « plus fort » et « plus rapide » en deux SKUs.
Pression concurrentielle de Kimi K3
La date cible de Grok 4.6 tombe ~10 jours après le shock open-weight de Kimi K3. Kimi K3 a atteint 1 679 points au Frontend Code Arena — premier open-weight au-dessus de tous les closed models — et rang 3 sur l'Intelligence Index d'Artificial Analysis. Musk a commenté les benchmarks Kimi K3 : « impressive ». L'accélération 4.6/4.7 de xAI s'inscrit dans la compétition intensifiée avec OpenAI, Anthropic et les labs chinois.
04 Comparaison : Grok vs Kimi K3 et pairs
| Modèle | Fournisseur | Paramètres | Contexte | Prix (input/output par 1M tokens) | Source |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | Non publié | 500K tokens | $2 / $6 | xAI officiel |
| Grok 4.6 (annoncé) | xAI | 1,5T | Non publié | Non publié | Post X de Musk (non vérifié) |
| Kimi K3 | Moonshot AI | 2,8T (MoE, ~16/896 experts actifs) | 1M tokens | $0,30 (cache hit)/$3 input, $15 output | Moonshot officiel |
| Claude Fable 5.1 (rumeur) | Anthropic | Non publié | Non publié | Rumeur : prix Fable 5 ($10/$50) | 36kr, WinCentral — Anthropic non confirmé |
| GPT-5.6 Sol | OpenAI | Non publié | Non publié | Non publié | OpenAI officiel |
Grok 4.6 et Claude Fable 5.1 sont des annonces/rumeurs — pas de benchmark head-to-head vérifié. Utile pour timing et positionnement approximatif.
05 Controverses, six étapes de préparation et données citables
À noter avant le release :
- Calendrier non vérifié : seule source = post X de Musk.
- Benchmarks et prix vides : « 1,5T » et « upgrade SFT/RL » sont des déclarations vendor pour l'instant.
- Controverses sécurité xAI : poursuite juillet pour génération CSAM ; Common Sense Media janvier — Grok parmi les pires pour protection des mineurs.
- Divergence avec « Pacing the Frontier » : le 28 juillet, plus de 1 200 employés OpenAI, Anthropic, etc. ont signé une lettre pour ralentir la frontier AI — xAI absent de la liste.
Six étapes de préparation Grok 4.6 :
- Suivre les canaux officiels xAI : xAI sur X et x.ai — pas seulement des sources secondaires.
- Revoir les benchmarks Grok 4.5 : notre test Grok 4.5 comme baseline 4.6.
- Créer un compte API xAI : clé API dans la console, tester Grok 4.5 pour latence et connectivité.
- Configurer un client OpenAI-compatible : Grok 4.5 dans Cursor ou agent custom, documenter la baseline token.
- Benchmark comparatif Kimi K3 : article Kimi K3 open-weight, mêmes workflows agent.
- Planifier le routing dual-SKU : Grok 4.6 (rapide) et 4.7 (qualité) avant le release.
from openai import OpenAI
client = OpenAI(
api_key="your_xai_api_key",
base_url="https://api.x.ai/v1"
)
response = client.chat.completions.create(
model="grok-4.5",
messages=[{"role": "user", "content": "Analyze this agent workflow..."}]
)
Données dures citables (xAI officiel, Musk X, Moonshot officiel, 30 juil. 2026) :
- Grok 4.6 paramètres : 1,5T (annoncé officiellement, tiers non vérifié)
- Grok 4.7 paramètres : 2,1T, fin août–déb. sept. (annoncé officiellement)
- Grok 4.5 prix : input $2/M token, output $6/M token, contexte 500K tokens
- Grok 4.5 SWE-Bench Pro : 64,7 % ; Terminal-Bench 2.1 : 83,3 %
- Efficacité token : Grok 4.5 ~19 000 tokens output/tâche vs Opus 4.8 ~67 000
- Kimi K3 : 2,8T paramètres, 1M tokens, Frontend Code Arena 1 679 points
- Rythme release : ~1 mois de 4.5 à 4.6, trois frontier en ~2 mois
06 FAQ, ruée des releases d'août et conclusion production
Quand sort exactement Grok 4.6 ?
Musk a dit « vers le 7 août 2026 » sur X — xAI n'a pas confirmé officiellement. Décalage possible.
Différence entre Grok 4.6 et 4.7 ?
Grok 4.6 : 1,5T, focus post-training SFT/RL. Grok 4.7 : 2,1T, quelques semaines après, meilleur que 4.6 sauf serving plus lent, efficacité token supérieure selon Musk.
Grok 4.6 bat Kimi K3 ou Claude Fable 5.1 ?
Trop tôt. Aucun benchmark Grok 4.6 publié ; Kimi K3 a des scores vérifiés ; Fable 5.1 non confirmé par Anthropic.
Prix de Grok 4.6 ?
Inconnu. Grok 4.5 à $2/$6 comme référence — vérifier les prix officiels au release.
Où utiliser Grok 4.6 ?
Probablement comme Grok 4.5 : Grok Build, API xAI, console en premier, puis plateformes tierces — non confirmé pour 4.6.
Si le calendrier de Musk tient, Grok 4.6/4.7 arrivent le même mois que le Claude Fable 5.1 rumoré — juste après le shock open-weight de Kimi K3. Août 2026 pourrait être l'un des mois les plus dense en releases LLM.
L'accès API à Grok est rapide, mais les équipes production paient trois coûts cachés : routing multi-modèles sur VPS partagés sans assez de RAM, pipelines agent sans runner stable 24/7, réintégrations répétées lors des changements de flagship. Pour agents Grok, analyse full-repo et serveurs MCP en production, les nœuds Mac bare-metal multi-région JEXCLOUD offrent plus de stabilité : mémoire unifiée Apple Silicon dédiée, pas de jitter d'oversubscription, gateways agent gérées par launchd, provisioning en 120 secondes. Nœuds et tarifs sur la page tarifs JEXCLOUD.