GROK 4.6
7_AOUT_
1,5T_
CIBLE.

Calendrier de lancement du modèle frontier Grok 4.6 xAI

Le 28 juillet 2026, Elon Musk a répondu sur X à Guillermo Rauch, PDG de Vercel : Grok 4.6 arriverait « autour du 7 août », suivi quelques semaines plus tard par Grok 4.7 — annonce informelle, sans communiqué officiel xAI. Enjeu : les équipes techniques font face à l'élasticité des calendriers « Musk time », à l'absence totale de benchmarks indépendants sur les specs annoncées, et à une fenêtre de choix compressée par le choc open-weight de Kimi K3. Conclusion : tant qu'xAI n'aura pas publié de fiche modèle, l'efficacité token et le coût réel par tâche — et non le seul nombre de paramètres — restent la base de décision la plus solide. Plan : chronologie, tableaux de specs, analyse SFT/RL, comparaison concurrentielle, réserves, analyse du goulot d'étranglement d'août 2026, guide en cinq étapes, FAQ.

Synthèse exécutive en 30 secondes

SourceRéponse X de Musk le 28 juillet (pas un billet xAI)
Grok 4.6~7 août · 1,5T paramètres · focus upgrade SFT/RL
Grok 4.7Fin août–début sept. · 2,1T · meilleur que 4.6, serving légèrement plus lent
Contexte concurrentiel~10 jours après les poids ouverts Kimi K3 · rumeurs Fable 5.1 le même mois
Tarifs / benchmarksTout est vide — pas de fiche modèle ni de scores tiers

1. Points sensibles : pourquoi cette preview compte — et pourquoi il faut la lire avec prudence

  1. « Musk time » a un historique. Les calendriers annoncés par xAI, Tesla et SpaceX ont régulièrement glissé de quelques jours à quelques semaines.
  2. La seule source est un tweet. Contrairement au lancement de Grok 4.5 avec 15 benchmarks documentés et une fiche modèle publiée, 4.6/4.7 n'ont aucune vérification indépendante.
  3. Kimi K3 a relevé la barre. La sortie open-weight du 26 juillet (2,8T, 1 679 points au Frontend Code Arena) a suscité l'éloge de Musk lui-même ; l'accélération de la feuille de route xAI s'explique le plus plausiblement par cette pression concurrentielle.

2. Chronologie : Grok 4.5 → 4.6 → 4.7

DateÉvénement
8 juil. 2026xAI lance Grok 4.5 : flagship coding/agentique, co-entraîné avec Cursor, contexte 500K, tarif $2/$6 par million de tokens entrée/sortie
16 juil.Aperçu hébergé de Kimi K3 par Moonshot AI
26 juil.Sortie complète open-weight de Kimi K3 (2,8T, contexte 1M)
28 juil.Musk publie la feuille de route Grok 4.6/4.7 ; le même jour, 1 200+ employés publient la lettre « Pacing the Frontier »
~7 aoûtCible Grok 4.6 : 1,5T paramètres, focus upgrade SFT/RL
~Fin août–début sept.Cible Grok 4.7 : 2,1T paramètres, globalement supérieur à 4.6, serving légèrement plus lent, meilleure efficacité token

3. Tableau de données clés

ModèleDateParamètresFocusStatut
Grok 4.3 Beta17 avr. 2026Non divulguéRéférencePublié
Grok 4.58 juil. 2026Non divulguéCoding/agentique, co-entraînement CursorPublié, benchmarké
Grok 4.6~7 août1,5TUpgrade SFT/RLAnnoncé via tweet
Grok 4.7~Fin août–début sept.2,1TAmélioration globale vs 4.6Annoncé via tweet

4. Pourquoi xAI met l'accent sur le post-entraînement, pas seulement l'échelle

4.1 SFT et RL en termes clairs

Le fine-tuning supervisé (SFT) façonne le comportement à partir d'exemples curatés ; l'apprentissage par renforcement (RL) enseigne des séquences agentiques multi-étapes via des signaux de récompense. Le cadrage de Musk — « SFT & RL significativement améliorés » — prolonge la stratégie de Grok 4.5 : les sessions réelles de développeurs Cursor ont produit Terminal-Bench 2.1 à 83,3 %, SWE-Bench Pro à 64,7 %, avec environ 15 954 tokens de sortie par tâche SWE-Bench Pro contre 67 020 pour Opus 4.8 — un écart d'efficacité de 4,2×.

4.2 L'arbitrage échelle vs vitesse

Grok 4.6 à 1,5T représente un vrai saut d'échelle, mais le cadrage de Grok 4.7 — plus grand à 2,1T, « meilleur sous tous les angles sauf légèrement plus lent à servir » — suggère deux SKU aux profils latence/qualité distincts, à l'image du duo Sonnet/Opus d'Anthropic et des tiers mini/full d'OpenAI.

4.3 La pression concurrentielle de Kimi K3

La cible Grok 4.6 tombe presque exactement 10 jours après la sortie open-weight de K3. K3 a dominé le Frontend Code Arena avec 1 679 points — premier modèle open-weight à battre tous les modèles fermés sur ce classement — et s'est classé troisième à l'Intelligence Index d'Artificial Analysis.

5. Comment Grok se positionne face au marché

ModèleÉditeurParamètresContexteTarif (entrée/sortie par 1M)Source
Grok 4.5xAINon divulgué500K$2 / $6xAI officiel
Grok 4.6 (annoncé)xAI1,5TNon divulguéNon divulguéPost X de Musk (non vérifié)
Kimi K3Moonshot AI2,8T (MoE, ~16/896 actifs)1M$0,30 cache hit / $3 miss entrée, $15 sortieMoonshot officiel
Claude Fable 5.1 (rumeur)AnthropicNon divulguéNon divulguéRumeur $10 / $50Fuites 36kr, WinCentral
GPT-5.6 SolOpenAINon divulguéNon divulguéNon divulguéOpenAI officiel

6. Ce qu'il faut signaler avant de faire confiance à ce calendrier

  • Source unique : un tweet — pas de billet xAI, pas de fiche modèle, pas de page produit.
  • Benchmarks et tarifs absents — « 1,5T paramètres » et « upgrade SFT/RL » restent des affirmations éditeur non vérifiées.
  • Controverses sécurité xAI — procès en juillet 2026 pour génération CSAM via contournement de garde-fous ; en janvier 2026, Common Sense Media a classé Grok parmi les pires produits IA pour la protection des mineurs.
  • Fracture sectorielle sur le rythme IA — le même jour que l'annonce 4.6/4.7, 1 200+ employés d'OpenAI, Anthropic, Google DeepMind et Meta ont publié « Pacing the Frontier » ; xAI est absent de la liste des signataires.

7. Perspective sectorielle : août 2026 comme goulot d'étranglement des lancements

Si le calendrier de Musk tient, Grok 4.6 et 4.7 arrivent le même mois qu'un Claude Fable 5.1 supposé et quelques semaines seulement après le choc open-weight de Kimi K3 — faisant d'août 2026 l'un des mois de lancement frontier les plus denses jamais enregistrés. Pour les équipes en évaluation, la durée de vie utile de chaque flagship se compresse à quelques semaines, non plus à des trimestres.

Le changement de fond est le passage du classement leaderboard au coût total par tâche : Grok 4.5 a prouvé que l'efficacité token de sortie peut compenser un score d'intelligence inférieur ; Kimi K3 a fait du self-hosting une option concrète ; un Fable 5.1 rumouré comprimerait encore la prime des modèles fermés. Trois voies — API fermée, open self-hosting, routage hybride — affrontent un test de stress concentré en août.

Pour les équipes d'ingénierie, le risque opérationnel est la dérive des tables de routage : alias modèles, chaînes de fallback et plafonds de coût, autrefois maintenus trimestriellement, deviennent des incidents hebdomadaires si trois modèles de classe trillion sortent dans la même fenêtre de 30 jours.

8. Guide de sélection en cinq étapes avant la fiche modèle

  1. Verrouiller vos sources d'information : blog xAI, console Grok Build, compte X de Musk — ne pas intégrer les specs annoncées dans les SLA avant le lancement.
  2. Construire un routage à trois niveaux : primaire (Grok 4.5 actuel ou API Kimi K3) → revue haute précision (Claude/GPT) → repli offline (poids ouverts quantifiés MLX locaux).
  3. Établir une baseline d'efficacité token : enregistrer les tokens de sortie par tâche repo réelle ; exécuter 20 tâches proches de la production sur tout nouveau modèle avant de changer le routage par défaut.
  4. Playbook fenêtre de lancement d'août : réserver une fenêtre d'évaluation de 48 heures par lancement majeur — pas de bascule production complète le jour J.
  5. Audit risque fournisseur : inclure la récente litigation sécurité xAI aux côtés des benchmarks techniques dans les revues enterprise.

9. FAQ

Quand sort exactement Grok 4.6 ?
Musk a indiqué « autour du 7 août 2026 » dans un post X ; xAI n'a pas confirmé officiellement la date.

Quelle différence entre Grok 4.6 et 4.7 ?
4.6 : 1,5T avec focus SFT/RL ; 4.7 : 2,1T, attendu quelques semaines plus tard, surpassant 4.6 sauf en vitesse de serving, où la latence est échangée contre une meilleure efficacité token.

Grok 4.6 battra-t-il Kimi K3 ou Claude Fable 5.1 ?
Trop tôt — aucun benchmark Grok 4.6 publié ; K3 a des scores vérifiés ; Fable 5.1 n'est pas confirmé par Anthropic.

Quel sera le tarif de Grok 4.6 ?
Inconnu. Grok 4.5 a été lancé à $2/$6 par million de tokens entrée/sortie comme point de référence.

Où pourra-t-on utiliser Grok 4.6 ?
D'après le déploiement de Grok 4.5 : probablement Grok Build, API xAI et console en premier, puis plateformes tierces comme Cursor.

10. Conclusion : course aux API frontier + couverture open-weight locale sur Mac

Un serveur cloud Windows/Linux peut suivre l'actualité Grok 4.6 et appeler des API, mais il peine sur les baselines open-weight locales, la résidence agent Cursor/OpenClaw, les replis Kimi K3 quantifiés MLX et le routage long contexte à mémoire unifiée. Dans un goulot d'étranglement de lancements d'août, la ressource rare n'est pas « quel modèle score le plus haut », mais une capacité de calcul auditable pour des comparaisons de tâches réelles sur 48 heures sans verrouillage fournisseur. Si vous avez besoin de MLX local pour la quantification K3, de nœuds distants 24/7 pour les tests de routage multi-modèles OpenClaw et de mémoire unifiée pour le fractionnement de sessions agent, adoptez une stack à trois niveaux : MLX local pour le quotidien et le repli offline ; API fermées frontier pour le raisonnement dur Grok/Claude ; nœuds Mac distants MACGPU pour la résidence agent et l'évaluation isolée — la meilleure couverture contre « Musk time » et la tempête de routage d'un mois de lancements.