Grok 4.6 date de sortie : la feuille de route xAI face à Kimi K3 et l'été des modèles frontière
À peine trois semaines après le lancement remarqué de Grok 4.5, Elon Musk dessine déjà la suite : un modèle intermédiaire axé sur l'apprentissage, puis un successeur plus massif mais plus lent à servir. Pour les équipes Mac qui arbitrent entre xAI, Moonshot et les rumeurs Anthropic, cet article pose le cadre professionnel : ce qui est annoncé, ce qui reste à prouver, et comment préparer une validation sans compromettre la machine de production.
Sommaire
Lectures connexes : Grok 4.5 — avis modèle code (8 juil.) · Kimi K3 poids ouverts (22 juil.) · DeepSeek V4 GA.
En bref
Le 28 juillet 2026, Elon Musk répond à Guillermo Rauch (@rauchg) sur X : Grok 4.6 arriverait vers le 7 août, avec 1,5 trillion de paramètres et un renforcement majeur du post-entraînement SFT/RL. Quelques semaines plus tard, Grok 4.7 (2,1T) prendrait le relais — plus capable, mais plus lent à l'inférence et plus efficient en tokens. Aucune fiche modèle, aucun benchmark ni tarif officiel pour 4.6 à ce jour. La seule source primaire reste ce fil X ; intégrez le Musk time dans vos plannings.
L'été 2026 accélère le rythme des modèles frontière. Grok 4.5, sorti le 8 juillet, s'est imposé comme référence coding à prix agressif ($2/$6 le million de tokens, 500K de contexte). Kimi K3, avec ses 2,8T et son million de tokens, a bouleversé la donne open weight fin juillet. Dans ce contexte, l'annonce Musk n'est pas anodine : xAI semble vouloir enchaîner trois générations en deux mois. Reste à distinguer la communication d'une feuille de route exécutable — et à ne pas confondre paramètres annoncés et performance mesurée.
01 · Trois tensions décisionnelles
- Le tweet comme seule boussole — Date, taille et orientation SFT/RL de Grok 4.6 proviennent d'une réponse X, pas d'un communiqué xAI. Pour Grok 4.5, la marque avait publié carte modèle et quinze benchmarks. Engager un budget ou figer une stack sur 4.6 aujourd'hui, c'est parier sur une promesse non auditée.
- Le vide des benchmarks — Kimi K3 affiche des scores tiers (SWE-bench, Artificial Analysis). Grok 4.6 n'a rien de comparable. Or Grok 4.5 a déjà démontré que l'efficacité token — environ 15 954 tokens de sortie par tâche SWE-Bench Pro contre ~67 020 pour Claude Opus 4.8 — compte autant que le classement brut.
- Un calendrier qui ne laisse pas respirer — Trois modèles en huit semaines, avec la rumeur Claude Fable 5.1 en août. Ajoutez le glissement habituel des dates Musk : le 7 août est une cible, pas un contrat. Les clés API ancrées sur la machine principale avant validation augmentent le coût de retour arrière.
02 · Chronologie : de Grok 4.5 à Grok 4.7
| Date | Événement |
|---|---|
| 8 juillet 2026 | Grok 4.5 en production — co-entraînement Cursor, contexte 500K, tarifs $2/$6, Terminal-Bench 83,3 %, SWE-Bench Pro 64,7 % |
| 16–27 juillet | Kimi K3 : lancement hébergé puis poids ouverts complets (2,8T, 1M tokens) |
| 28 juillet | Musk dévoile la roadmap 4.6/4.7 sur X. Même jour : lettre ouverte « Pacing the Frontier » (1 200+ signataires) |
| ~7 août | Grok 4.6 visé : 1,5T, upgrade SFT/RL — non commercialisé |
| Fin août | Grok 4.7 : 2,1T, supérieur sauf latence serving — non commercialisé |
Le blog xAI et les pages produit n'avaient pas synchronisé ces dates au 30 juillet. Toute planification doit prévoir un décalage de plusieurs jours à deux semaines.
03 · Fiche technique : série Grok
| Modèle | Paramètres | Contexte | Positionnement | État |
|---|---|---|---|---|
| Grok 4.5 | non communiqué | 500K | Code & agents, sessions Cursor | Disponible |
| Grok 4.6 | 1,5T | n/c | SFT/RL renforcé | Annoncé |
| Grok 4.7 | 2,1T | n/c | Meilleur que 4.6, serving plus lent | Annoncé |
04 · Pourquoi SFT/RL change la donne
Musk insiste : l'enjeu de Grok 4.6 n'est pas seulement « plus gros », mais « mieux entraîné ». Le fine-tuning supervisé (SFT) aligne le modèle sur des démonstrations humaines de qualité ; le renforcement (RL) récompense les séquences d'actions correctes dans les workflows agents. C'est précisément ce qui a distingué Grok 4.5 sur les benchmarks de terminal et de code réel.
La stratégie à deux SKU — 4.6 rapide, 4.7 plus lourd — rappelle la segmentation Sonnet/Opus chez Anthropic. Elle invite à choisir selon la latence acceptable et le coût par tâche, plutôt que selon le nom du modèle sur la slide marketing.
05 · Panorama concurrentiel (fin juillet 2026)
| Modèle | Éditeur | Paramètres | Contexte | Tarif (In/Out par M) |
|---|---|---|---|---|
| Grok 4.5 | xAI | n/c | 500K | $2 / $6 |
| Grok 4.6 | xAI | 1,5T | n/c | n/c |
| Kimi K3 | Moonshot | 2,8T MoE | 1M | $0,30–$3 / $15 |
| Claude Fable 5.1 | Anthropic | n/c | n/c | Rumeur août |
Les lignes 4.6 et Fable 5.1 relèvent d'annonces ou de rumeurs — pas de comparaison benchmark valide avant sortie officielle.
06 · Contexte et réserves professionnelles
- Procédure CSAM (juillet) — xAI a assigné un utilisateur accusé d'avoir contourné les filtres de sécurité. Question de gouvernance à peser à part des performances techniques.
- « Pacing the Frontier » — Le 28 juillet, plus de 1 200 employés de labs majeurs appellent à ralentir le déploiement des IA frontière. xAI n'a pas signé, tout en accélérant sa roadmap.
- Absence totale de benchmarks 4.6 — Contrairement à 4.5, aucune carte modèle publique. Les 1,5T restent une affirmation éditeur jusqu'à preuve indépendante.
07 · Août 2026 : un mois sous pression
Si le calendrier Musk tient, août verra potentiellement Grok 4.6, Grok 4.7 et la rumeur Fable 5.1 se chevaucher — après le choc Kimi K3. Pour les équipes produit, la métrique durable n'est plus le rang sur un leaderboard, mais le coût par tâche réelle et la consommation de tokens. C'est dans cette fenêtre étroite qu'un environnement de test isolé devient un atout stratégique plutôt qu'un luxe.
08 · Cinq étapes de préparation (développeurs Mac)
- Fixer la baseline Grok 4.5 — Via API xAI ou Cursor : un scénario long document, correction de bug, refactor multi-fichiers. Noter tokens et coût.
- Surveiller les canaux officiels — x.ai/news, @xai. En cas de divergence X/blog, privilégier le blog.
- Comparer avec Kimi K3 dès maintenant — Même dépôt, mêmes prompts : palliatif crédible en l'absence de benchmarks 4.6.
- Valider sur Mac loué isolé — Clé xAI hors Keychain principal ; tests Grok Build et routage Cursor sans trace durable.
- Documenter avec étiquette « non confirmé » — Source Musk 28/07, statut à réviser sous 24 h après annonce xAI.
09 · FAQ
Q : Quand sortira Grok 4.6 ?
R : Musk vise environ le 7 août 2026 sur X — pas de confirmation xAI. Prévoyez un glissement (Musk time).
Q : Différence entre 4.6 et 4.7 ?
R : 4.6 = 1,5T, focus SFT/RL. 4.7 = 2,1T, meilleur sauf vitesse d'inférence, plus efficient en tokens. Tous deux non sortis.
Q : Plus fort que Kimi K3 ou Fable 5.1 ?
R : Indéterminé. K3 a des mesures tierces ; Fable 5.1 est une rumeur ; 4.6 n'a aucun score public.
Q : Quel tarif pour 4.6 ?
R : Non annoncé. Référence 4.5 : $2/$6 par million de tokens.
Q : Où l'utiliser ?
R : Nulle part officiellement. Le schéma 4.5 (Build, API, Cursor) est probable mais non confirmé.
10 · Mac loué en environnement isolé : valider Grok sans exposer la machine principale
Inferer 1,5T localement sur un MacBook n'est pas réaliste. Le chemin passe par l'API xAI ou le routage Cursor — mais déposer la clé sur la machine de production, multiplier les essais long contexte et préparer la bascule 4.5 → 4.6 expose Keychain, historique shell et budget.
Le réflexe professionnel : un Mac Apple Silicon loué, dédié à la recette Grok 4.5 aujourd'hui et à l'A/B 4.6 demain, puis détruit après validation. Les tarifs sont sur la page tarifs bare-metal macOS.
11 · Sources
- Primaire : post X d'Elon Musk, 28 juillet 2026 (@rauchg)
- Officiel xAI : Grok 4.5 (x.ai/news), carte modèle media.x.ai
- Concurrence : Moonshot Kimi K3, Artificial Analysis
- Contexte : Pacing the Frontier (The Verge), procédure CSAM xAI (Ars Technica)
- Rumeur Fable 5.1 : 36kr, WinCentral
Rédigé le 30 juillet 2026. Vérifier x.ai avant toute décision de production sur Grok 4.6.