Am 28. Juli antwortete Elon Musk auf X dem Vercel-CEO Guillermo Rauch: xAI plane Grok 4.6 mit 1,5 Billionen Parametern für etwa den 7. August 2026, gefolgt von Grok 4.7 mit 2,1 Billionen Parametern wenige Wochen später. Nur einen Monat nach Grok 4.5 würde xAI damit drei Frontier-Modelle innerhalb eines Sommers liefern.
Dieser Beitrag richtet sich an Teams, die Agent-Programmierung, Cursor-Workflows oder xAI-APIs evaluieren. Er liefert eine datenbasierte Zeitachse, zwei Vergleichstabellen, eine SFT/RL-Einordnung, sechs Vorbereitungsschritte und FAQ — mit klarer Kennzeichnung unbestätigter Angaben. Nach dem Lesen wissen Sie, wie Grok 4.6 und 4.7 positioniert sind, wie Kimi K3 den Druck erhöht und was Enterprise-Teams vor dem Release prüfen sollten.
01 Wann kommt Grok 4.6? Zeitachse und Entscheidungsdruck
Typische Engpässe vor einem Frontier-Release:
- Einzelne Informationsquelle: Details zu Grok 4.6/4.7 stammen bislang aus Musks X-Antwort; ein offizieller xAI-Blogpost fehlt noch.
- „Musk time“: Musks historische Terminangaben verschieben sich oft um Tage bis zwei Wochen — der 7. August ist kein verbindliches SLA.
- Komprimierter Auswahlzyklus: Kimi K3 veröffentlichte am 26. Juli vollständige Open Weights; Grok 4.6 soll etwa zehn Tage später folgen — wer gerade Grok 4.5 produktiv nutzt, steht vor einem erneuten Migrationsfenster.
- Keine unabhängigen Benchmarks: Im Gegensatz zum ausführlichen Grok-4.5-Modellkarten-Release liegen für 4.6 weder Preise noch SWE-Bench-Werte vor.
- Compliance-Risiko bei US-Cloud-APIs: Für EU-Unternehmen, die Entwickler-Sessions an xAI senden, bleibt die DSGVO-Konformität (Auftragsverarbeitung, Drittlandtransfer) unabhängig vom Modellnamen zu prüfen.
- 08.07.2026: xAI veröffentlicht Grok 4.5 als Flaggschiff für Programmierung und Agenten — Cursor-Kooperation, echte Entwickler-Sessions als Trainingsdaten, 500.000 Token Kontext, Preis $2/$6 pro Million Token (Input/Output).
- 16.07.2026: Moonshot AI stellt Kimi K3 als Managed Service bereit.
- 26.07.2026: Kimi K3 Open Weights (2,8 Billionen Parameter MoE, 1 Million Token Kontext) erscheinen einen Tag früher als angekündigt.
- 28.07.2026: Musk nennt in der Antwort an Rauch erstmals öffentlich Grok 4.6 (1,5 Billionen, SFT/RL-Fokus, ca. 7. August) und Grok 4.7 (2,1 Billionen, Ende August/Anfang September). Am selben Tag unterzeichnen über 1.200 Mitarbeitende großer US-Labs den Open Letter „Pacing the Frontier“ — xAI fehlt auf der Unterzeichnerliste.
- ca. 07.08.2026 (Ziel): Geplanter Grok-4.6-Release; Schwerpunkt laut Musk auf SFT und RL, nicht allein auf Parameterwachstum.
- Ende August – Anfang September 2026 (Schätzung): Grok 4.7 mit 2,1 Billionen Parametern; Musk: „überall besser als 4.6, etwas langsamer, höhere Token-Effizienz“.
Musks Zeitangaben sind Orientierung, kein Release-SLA. Verbindlich bleiben xAI-Offizialkanäle (@xai, x.ai/news, console.x.ai) — nicht einzelne X-Threads.
02 Grok 4.6 vs. Kimi K3 und Fable 5.1: Parameter- und Preismatrix
| Modell | Release / Ziel | Parameter | Schwerpunkt | Status |
|---|---|---|---|---|
| Grok 4.3 Beta | 17.04.2026 | unveröffentlicht | Vorgänger-Baseline | veröffentlicht |
| Grok 4.5 | 08.07.2026 | unveröffentlicht (kein MoE-SKU) | Programmierung, Agenten, Cursor-Training | veröffentlicht |
| Grok 4.6 | ca. 07.08.2026 | 1,5 Billionen | SFT/RL-Upgrade | angekündigt, unveröffentlicht |
| Grok 4.7 | Ende Aug. – Anf. Sep. 2026 | 2,1 Billionen | stärker als 4.6, höhere Token-Effizienz | angekündigt, unveröffentlicht |
Hinweis: Parameterangaben und Zeitpläne für Grok 4.6/4.7 stammen aus Musks X-Post vom 28.07.2026, nicht aus einer xAI-Modellkarte. Keine unabhängige Verifikation.
| Modell | Anbieter | Parameter | Kontext | Preis (Input/Output, pro Mio. Token) |
|---|---|---|---|---|
| Grok 4.5 | xAI | unveröffentlicht | 500.000 Token | $2 / $6 |
| Grok 4.6 (Ankündigung) | xAI | 1,5 Billionen | unveröffentlicht | unveröffentlicht |
| Kimi K3 | Moonshot AI | 2,8 Billionen MoE (16/896 Experten aktiv) | 1.000.000 Token | $0,30 (Cache) / $3 Input, $15 Output |
| Claude Fable 5.1 (Gerücht) | Anthropic | unveröffentlicht | unveröffentlicht | Gerücht: Fable-5-Niveau ($10/$50) |
| GPT-5.6 Sol | OpenAI | unveröffentlicht | unveröffentlicht | unveröffentlicht |
Grok 4.6 und Fable 5.1 sind Ankündigungen oder Gerüchte — keine belastbare Benchmark-Basis. Kimi-K3-Werte stammen aus Moonshots Modellkarte und Open-Weight-Release.
03 Grok 4.6 SFT und RL: Warum xAI nicht nur Parameter skaliert
Was SFT und RL in Agent-Stacks leisten
Supervised Fine-Tuning (SFT) korrigiert Ausgabemuster anhand kuratierter Beispiele; Reinforcement Learning (RL) optimiert mehrstufige Agentenketten über Belohnungssignale. Musk betonte ausdrücklich, dass Grok 4.6 vor allem in SFT und RL gewinnt — nicht allein durch 1,5 Billionen Parameter. Das setzt Grok 4.5 fort: Mit Cursor-Trainingsdaten erreichte 4.5 laut xAI-Modellkarte Terminal-Bench 2.1 mit 83,3 % und SWE-Bench Pro mit 64,7 %, bei deutlich weniger Output-Tokens als Claude Opus 4.8 (ca. 15.954 vs. 67.020 Token pro SWE-Bench-Pro-Lauf — Faktor 4,2×).
Zwei-SKU-Strategie: 4.6 schneller, 4.7 stärker
Grok 4.6 (1,5 Billionen) und Grok 4.7 (2,1 Billionen) deuten auf bewusste Produktsegmentierung: 4.7 soll laut Musk „überall besser“ sein, aber langsamer inferieren — xAI trennt damit Latenz-optimierte und Qualitäts-optimierte Pfade statt eines Universal-SKUs.
Wettbewerbsdruck durch Kimi K3
Kimi K3 landete im Frontend Code Arena mit 1.679 Punkten als erstes Open-Weight-Modell vor allen Closed-Source-Rivalen; im Artificial-Analysis-Index rangiert es global auf Platz drei. Musk kommentierte K3-Evaluierungen mit „beeindruckend“. Der Grok-4.6-Zeitplan fällt etwa zehn Tage nach K3s Open-Weight-Release — ein Signal, dass xAI den Iterationszyklus verkürzt.
Risiken und offene Punkte
- Keine unabhängige Verifikation: Parameter und SFT/RL-Claims stammen ausschließlich aus Musks X-Thread.
- Content-Safety-Kontext: Im Juli reichte xAI erstmals Klage gegen einen Nutzer ein, der Grok missbrauchte, um CSAM zu erzeugen. Common Sense Media stufte Grok Anfang 2026 als eines der schwächsten Produkte beim Minderjährigenschutz ein — für Enterprise-Einsatz relevant neben Leistungsmetriken.
- Regulierungs-Gegentrend: Am Release-Tag von Musks Roadmap erscheint der „Pacing the Frontier“-Brief — xAI beschleunigt, während OpenAI- und Anthropic-Mitarbeitende bremsen wollen.
- DSGVO bei Agent-Daten: Grok 4.5 wurde mit echten Entwickler-Sessions trainiert. Teams, die Code, Tickets oder Kundendaten über die xAI-API routen, brauchen vor Grok 4.6 eine aktualisierte Datenschutz-Folgenabschätzung und ggf. EU-Proxy-Routing — unabhängig vom Modell-Upgrade.
Fällt der August-Zeitplan zu, konkurrieren Grok 4.6, Grok 4.7 und das gemunkelte Claude Fable 5.1 im selben Monat — nach Kimi K3 im Juli könnte August 2026 einer der release-dichtesten Frontier-Monate werden. Für Entscheider zählen Token-Effizienz und Gesamtkosten pro Agent-Lauf mehr als reine Parameterzahlen.
04 Sechs Schritte: Grok-4.6-Release vorbereiten
Bevor Modellkarte und Preise vorliegen, lohnt sich die Infrastruktur-Vorbereitung — so vermeiden Sie eine Woche Ad-hoc-Migration nach dem Release.
curl -s https://api.x.ai/v1/models \
-H "Authorization: Bearer $XAI_API_KEY" \
| jq '.data[].id'
Offizielle Quellen; nach Upstream-Updates erneut prüfen:
https://docs.x.ai/developers/models
Sechs-Schritte-Checkliste:
- Offizielle Kanäle abonnieren: @xai auf X, x.ai/news und console.x.ai — Musks Posts sind Hinweise, keine Vertragsgrundlage.
- Grok-4.5-Kostenbaseline messen: Token pro Agent-Task und USD-Kosten bei $2/$6 erfassen; Vergleichswert für 4.6-Preisänderungen.
- Entscheidungsmatrix aktualisieren: Kimi K3 (2,8T Open Weights), Fable 5.1 (Gerücht), GPT-5.6 Sol in einer Tabelle nach Programmierung, Kontext und Preis bewerten.
- Routing-Slot reservieren: In LiteLLM oder Cursor
grok-4.6als Platzhalter eintragen — Release-Tag nur Model-ID tauschen für A/B-Tests. - Release-Day-Validierungsliste: Kontextfenster, SWE-Bench/Terminal-Bench, Input/Output-Preis, Responses-API-Cache — Punkt für Punkt gegen Modellkarte abhaken.
- 24/7-Agent-Infrastruktur planen: Lang laufende Cursor-Agenten oder OpenClaw-Gateways brechen ab, wenn der lokale Mac schläft. Für produktive Agent-Schleifen Bare-Metal-Knoten mit dediziertem Apple Silicon vorsehen — Details in Schritt 6 der Enterprise-Checkliste unter DSGVO-Aspekt (keine Session-Daten auf schlafenden Endgeräten zwischenspeichern).
05 Zitierbare Daten, FAQ, DSGVO und Zusammenfassung
Zitierbare Kennzahlen (EEAT):
- Grok 4.6 Zielparameter: 1,5 Billionen, Schwerpunkt SFT/RL (Quelle: Musk, X-Antwort an @rauchg, 28.07.2026 — nicht durch xAI-Modellkarte verifiziert).
- Grok 4.7 Zielparameter: 2,1 Billionen, „überall besser als 4.6, etwas langsamer, höhere Token-Effizienz“ (Quelle: dieselbe Antwort; Ziel Ende August/Anfang September 2026).
- Grok 4.5 Token-Effizienz: SWE-Bench Pro ca. 15.954 Output-Token vs. Opus 4.8 ca. 67.020 — Faktor 4,2× (Quelle: xAI Grok-4.5-Modellkarte, 08.07.2026).
FAQ:
- An welchem Tag erscheint Grok 4.6? Musk nannte „etwa 7. August 2026“. Das ist keine xAI-Offiziellbestätigung; Verzögerungen um Tage bis Wochen sind historisch üblich.
- Was unterscheidet Grok 4.6 von Grok 4.7? 4.6: 1,5 Billionen, SFT/RL-Fokus, früherer Termin. 4.7: 2,1 Billionen, laut Musk stärker aber langsamer, höhere Token-Effizienz, einige Wochen nach 4.6.
- Schlägt Grok 4.6 Kimi K3 oder Fable 5.1? Unbekannt. Grok 4.6 hat keine öffentlichen Benchmarks; Kimi K3 hat gemessene Programmier-Rankings; Fable 5.1 ist von Anthropic nicht bestätigt.
- Wie wird Grok 4.6 preislich liegen? Unveröffentlicht. Grok 4.5 kostet $2/$6 pro Million Token — als Orientierung, nicht als Zusage für 4.6.
- Wo nutze ich Grok 4.6 nach Release? Wahrscheinlich zuerst Grok Build, xAI-API und Console — analog zu Grok 4.5. Drittanbieter-Integrationen folgen typischerweise Tage bis Wochen später; verbindlich sind nur xAI-Ankündigungen.
- DSGVO: Was ändert sich für EU-Teams? Ein neues Modell ändert nicht automatisch den Rechtsrahmen. Prüfen Sie weiterhin Auftragsverarbeitungsvertrag mit xAI, Verarbeitungsverzeichnis, Datenminimierung in Prompts und ob Code/Kundendaten in die USA transferiert werden. Self-hosted Kimi K3 kann für sensible Workloads eine Alternative sein — mit eigenem Betriebsaufwand.
Zusammenfassung: Grok 4.6 signalisiert xAIs beschleunigte Iteration nach Kimi K3 — 1,5 Billionen Parameter plus SFT/RL-Feintuning sind vielversprechend, bleiben aber bis zur Modellkarte unbestätigt. Der August-Stapel aus Grok 4.6, 4.7 und Fable 5.1 macht das Auswahlfenster kurz: Kostenbaseline und Routing-Framework vor dem Release aufzubauen ist pragmatischer als Parameter-Jagd.
Weitere Primärquellen; nach Upstream-Updates erneut prüfen:
https://github.com/moonshotai/Kimi-K3
Grok-Agent-Workflows auf einem lokalen Mac scheitern oft an Schlafmodus-Unterbrechungen, parallelen Repositories auf einem Gerät und fehlender 24/7-Verfügbarkeit. Für Cursor Agent, Grok Build oder OpenClaw Gateway in Produktion ist CALMVPS Bare-Metal-Mac-Mini-Miete meist die bessere Wahl: dediziertes Apple Silicon, native Metal-Beschleunigung, monatliche Abrechnung, Lieferung in ca. 120 Sekunden — schwere Agent-Schleifen in die Cloud, Review lokal. Preise unter Mietpreise.