Le 28 juillet, en réponse au PDG de Vercel Guillermo Rauch sur X, Elon Musk a indiqué que xAI publierait Grok 4.6 autour du 7 août 2026, avec un modèle de 1,5 trillion de paramètres, suivi de Grok 4.7 (2,1T) quelques semaines plus tard. À peine un mois après Grok 4.5, xAI enchaîne trois modèles frontier en un été.
Cet article s'adresse aux équipes techniques qui évaluent des outils agent de code et suivent la feuille de route xAI. Il retrace la chronologie, compare les chiffres annoncés à Kimi K3 et aux rumeurs Fable 5.1, signale explicitement ce qui reste non confirmé, et propose un cadre de préparation avant la sortie.
01 De Grok 4.5 à 4.6 et 4.7 : une accélération inédite
Contraintes réelles avant toute décision d'achat ou de migration :
- Source d'information unique : les détails sur Grok 4.6/4.7 proviennent pour l'instant d'une seule réponse de Musk sur X ; le blog officiel xAI n'a pas encore publié de communiqué structuré.
- Elasticité du « Musk time » : les calendriers annoncés par Musk glissent souvent de quelques jours à deux semaines ; le 7 août est une cible, pas une date contractuelle.
- Fenêtre de choix compressée : Kimi K3 a été entièrement open-sourcé le 27 juillet ; Grok 4.6 viserait le 7 août, soit environ dix jours après — le cycle de remplacement des modèles s'accélère.
- Benchmarks et tarifs absents : contrairement au lancement de Grok 4.5 avec sa fiche technique détaillée, Grok 4.6 n'a aucune évaluation indépendante publiée à ce jour.
- 8 juillet 2026 : xAI publie Grok 4.5, modèle flagship orienté programmation et tâches agent, entraîné avec Cursor sur des sessions réelles de développeurs, contexte 500 000 tokens, tarif $2/$6 par million de tokens (entrée/sortie).
- 16 juillet 2026 : Kimi K3 de Moonshot AI arrive en service hébergé, puis le 26 juillet les poids complets sont publiés : 2,8T paramètres MoE, contexte 1M tokens.
- 28 juillet 2026 : Musk révèle publiquement la feuille de route Grok 4.6/4.7 en répondant à Rauch — source principale de cet article. Le même jour, plus de 1 200 employés d'OpenAI, Anthropic et d'autres labos signent la lettre ouverte « Pacing the Frontier », appelant à des mécanismes de rythme volontaire du développement IA.
- Autour du 7 août 2026 (cible) : sortie prévue de Grok 4.6, 1,5T paramètres, accent sur le post-entraînement SFT et RL plutôt que sur la seule montée en taille.
- Fin août – début septembre 2026 (estimation) : Grok 4.7 à 2,1T paramètres ; Musk indique qu'il surpasse 4.6 sur la plupart des axes, avec une inférence légèrement plus lente mais une meilleure efficacité token.
Les calendriers de Musk comportent historiquement une marge d'incertitude — le « Musk time ». Avant toute planification, vérifiez les annonces du compte officiel xAI ou du site x.ai.
02 Données clés et matrices comparatives
| Modèle | Date cible | Paramètres | Positionnement | Statut |
|---|---|---|---|---|
| Grok 4.3 Beta | 17 avril 2026 | Non divulgué | Génération précédente | Publié |
| Grok 4.5 | 8 juillet 2026 | Non divulgué (SKU non MoE) | Code et agents, co-entraînement Cursor | Publié |
| Grok 4.6 | ~7 août 2026 | 1,5T | Upgrade SFT/RL majeur | Annoncé, non publié |
| Grok 4.7 | ~fin août – début sept. | 2,1T | Supérieur à 4.6, efficacité token accrue | Annoncé, non publié |
Les paramètres, tarifs et scores proviennent des déclarations xAI/Musk ; Grok 4.6 et 4.7 n'ont pas encore de benchmark tiers. Les lignes « annoncé » doient être confirmées à la publication officielle.
| Modèle | Éditeur | Paramètres | Fenêtre de contexte | Tarif ($/M tokens, entrée/sortie) |
|---|---|---|---|---|
| Grok 4.5 | xAI | Non divulgué | 500 000 tokens | $2 / $6 |
| Grok 4.6 (annoncé) | xAI | 1,5T | Non divulgué | Non divulgué |
| Kimi K3 | Moonshot AI | 2,8T MoE (16/896 experts actifs) | 1M tokens | $0,30 cache / $3 entrée, $15 sortie |
| Claude Fable 5.1 (rumeur) | Anthropic | Non divulgué | Non divulgué | Rumeur : tarifs Fable 5 ($10/$50) |
| GPT-5.6 Sol | OpenAI | Non divulgué | Non divulgué | Non divulgué |
Les lignes Grok 4.6 et Fable 5.1 relèvent d'annonces ou de rumeurs ; elles ne constituent pas une comparaison benchmark formelle, seulement un repère de calendrier et de positionnement.
03 SFT et RL : l'upgrade ne se résume pas à « plus gros »
Ce que SFT et RL changent concrètement
Le fine-tuning supervisé (SFT) corrige les habitudes de sortie via des exemples annotés ou filtrés ; le renforcement (RL) aligne le modèle sur des signaux de récompense dans des chaînes de tâches réelles, notamment les workflows agent multi-étapes. Musk insiste : l'apport principal de Grok 4.6 porte sur « SFT & RL », pas sur la seule échelle paramétrique. Cela prolonge la stratégie de Grok 4.5 — co-entraîné avec Cursor sur des sessions développeur authentiques — qui a obtenu 83,3 % sur Terminal-Bench 2.1 et 64,7 % sur SWE-Bench Pro tout en consommant environ 15 954 tokens de sortie par tâche contre ~67 020 pour Claude Opus 4.8, soit un ratio d'environ 4,2×.
Pourquoi xAI cumule volume paramétrique et post-entraînement
Les 1,5T de Grok 4.6 marquent un saut net par rapport à 4.5, mais Musk précise aussitôt que 4.7 (2,1T) sera « un peu plus lent en inférence » — signe que xAI segmente déjà deux profils : puissance brute versus latence et coût token. Deux SKUs complémentaires plutôt qu'un modèle unique pour tous les cas d'usage agent.
Pression concurrentielle autour de Kimi K3
Le calendrier Grok 4.6 tombe environ dix jours après l'open-sourcing intégral de Kimi K3. Ce dernier domine le Frontend Code Arena (1679 points) et se place troisième sur l'indice Artificial Analysis — premier modèle open weight à dépasser l'ensemble des modèles fermés sur ce classement. Musk a commenté publiquement les évaluations K3 comme « impressionnantes ». L'accélération xAI s'inscrit dans un contexte où OpenAI, Anthropic et les éditeurs chinois resserrent le rythme de publication.
Points de vigilance
- Calendrier non validé par un tiers : une seule réponse X, sans fiche modèle xAI à l'appui.
- Benchmarks et tarifs vides : « 1,5T » et « SFT/RL renforcés » restent des affirmations unilatérales.
- Controverses sécurité xAI : en juillet, xAI a intenté un procès à un utilisateur accusé d'avoir contourné les garde-fous Grok pour générer du CSAM — première action en justice de l'entreprise sur des contenus IA générés. En janvier, un rapport Common Sense Media classait Grok parmi les produits IA les moins protecteurs pour les mineurs.
- Décalage avec l'appel au ralentissement : le 28 juillet, la lettre « Pacing the Frontier » recueille le soutien d'OpenAI et Anthropic ; xAI n'y figure pas.
Si le calendrier Musk se tient, Grok 4.6, Grok 4.7 et le Claude Fable 5.1 attendu (plusieurs médias pointent vers août) pourraient converger dans le même mois, après le choc open weight de Kimi K3 en juillet. Le mois d'août 2026 risque d'être l'un des plus denses en lancements frontier de l'histoire récente. Pour les équipes d'ingénierie, l'efficacité token et le coût réel l'emporteront sur le nombre brut de paramètres.
04 Six étapes de préparation avant la sortie de Grok 4.6
Avant la fiche modèle et la grille tarifaire officielles, les équipes peuvent poser l'infrastructure et le cadre de comparaison pour éviter de courir après l'annonce.
curl -s https://api.x.ai/v1/models \
-H "Authorization: Bearer $XAI_API_KEY" \
| jq '.data[].id'
Sources officielles primaires ; revérifier les liens après mises à jour en amont :
https://docs.x.ai/developers/models
Six étapes concrètes :
- Ancrer les sources officielles : suivre @xai sur X, x.ai/blog et console.x.ai ; les tweets de Musk servent d'alerte précoce, la fiche modèle fait foi.
- Établir une baseline de coût Grok 4.5 : mesurer tokens et dollars par tâche agent sur la grille $2/$6 actuelle ; préparer la comparaison si 4.6 modifie les tarifs.
- Mettre à jour la matrice concurrentielle : intégrer Kimi K3 (2,8T open weight), Fable 5.1 (rumeur) et GPT-5.6 Sol sur trois axes — code, contexte long, prix.
- Pré-réserver un slot de routage : dans LiteLLM ou la liste de modèles Cursor, garder un emplacement
grok-4.6pour basculer l'ID le jour J et lancer un A/B immédiat. - Rédiger une checklist de validation J0 : fenêtre de contexte, scores SWE-Bench/Terminal-Bench, tarifs entrée/sortie, prise en charge du cache Responses API.
- Dimensionner l'infrastructure agent 24/7 : les boucles longues Grok API et OpenClaw Gateway exigent un nœud toujours actif ; la veille locale d'un Mac interrompt les cycles — anticiper un hébergement bare metal cloud.
05 Données citables, FAQ et synthèse
Données citables (EEAT) :
- Paramètres cibles Grok 4.6 : 1,5T, accent post-entraînement SFT/RL (source : réponse Musk du 28 juillet à @rauchg, non confirmée par fiche xAI).
- Paramètres cibles Grok 4.7 : 2,1T, supérieur à 4.6 sur la plupart des axes, inférence légèrement plus lente, meilleure efficacité token (source : idem, fenêtre fin août – début septembre).
- Référence d'efficacité Grok 4.5 : ~15 954 tokens de sortie par tâche SWE-Bench Pro contre ~67 020 pour Opus 4.8, ratio ~4,2× (source : fiche Grok 4.5, 8 juillet 2026).
FAQ :
- Quelle est la date exacte de sortie de Grok 4.6 ? Musk a indiqué « autour du 7 août » dans un échange informel sur X. Ce n'est pas une date confirmée par xAI ; la publication peut avancer ou reculer.
- Quelle différence entre Grok 4.6 et Grok 4.7 ? Grok 4.6 vise 1,5T avec un focus SFT/RL ; Grok 4.7 monterait à 2,1T quelques semaines après, avec des capacités globalement supérieures mais une inférence un peu plus lente et une meilleure efficacité token selon Musk.
- Grok 4.6 battra-t-il Kimi K3 ou Claude Fable 5.1 ? Impossible à trancher aujourd'hui. Grok 4.6 n'a aucun score public ; Kimi K3 dispose de mesures réelles sur plusieurs benchmarks code ; Fable 5.1 n'est pas encore annoncé officiellement par Anthropic.
- Quel tarif pour Grok 4.6 ? Non communiqué. La grille Grok 4.5 ($2/$6 par million de tokens) peut servir de repère, sans garantie de continuité.
- Où accéder à Grok 4.6 à la sortie ? Sur le modèle de Grok 4.5, la distribution devrait passer par Grok Build, l'API xAI et la console, puis des intégrations tierces — à confirmer dans l'annonce officielle.
Synthèse : Grok 4.6 signale une accélération xAI après le choc Kimi K3 — 1,5T paramètres couplés à un post-entraînement SFT/RL affûté. Tant que la fiche modèle n'est pas publiée, toute affirmation de performance doit rester étiquetée « non confirmée ». Le mois d'août promet une densité de lancements rare ; une baseline de coût et un routage prêt valent mieux qu'une course aux chiffres de paramètres.
Sources complémentaires ; revérifier après mises à jour :
https://github.com/moonshotai/Kimi-K3
Faire tourner des agents Grok ou OpenClaw Gateway sur un Mac personnel laisse trois failles structurelles : la mise en veille coupe les boucles longues, plusieurs dépôts en parallèle saturent la machine locale, et un nœud 24/7 reste difficile à garantir. Pour des workflows Cursor Agent, Grok Build ou OpenClaw Gateway en production, la location Mac Mini bare metal CALMVPS est en général le meilleur choix : Apple Silicon dédié, accélération Metal native, facturation mensuelle flexible, livraison en ~120 secondes, boucles agent lourdes déportées sur le cloud pendant que la revue reste locale. Voir les tarifs de location.