28 июля 2026 Илон Маск в ответе CEO Vercel Guillermo Rauch на X заявил: xAI выпустит Grok 4.6 с 1,5 триллиона параметров примерно 7 августа, а через несколько недель — Grok 4.7 на 2,1T. Между Grok 4.5 (8 июля) и 4.6 пройдёт меньше месяца — xAI планирует три frontier-релиза за одно лето.
Материал для команд, которые маршрутизируют coding-agent через Cursor, Grok Build или OpenClaw Gateway и следят за roadmap xAI. Разберём хронологию, сравним с Kimi K3, разложим SFT/RL post-training pipeline и отметим, что не подтверждено официальным model card.
01 Grok 4.5 → 4.6 → 4.7: скорость итераций и болевые точки
Что ломает планирование до официального релиза:
- Единственный первичный источник: детали 4.6/4.7 — один reply Маска на X; blog xAI и product page пока молчат.
- «Musk time»: исторически сроки сдвигаются на дни–две недели; «~7 августа» — ориентир, не SLA.
- Сжатое окно выбора: Kimi K3 полностью open-weight 26–27 июля; до целевого релиза Grok 4.6 — ~10 дней. Флагман 4.5 может устареть до полного rollout.
- Нулевые независимые бенчмарки: у Grok 4.5 был подробный model card; у 4.6 — только заявления о масштабе и post-training.
- 08.07.2026: xAI релизит Grok 4.5 — coding/agent SKU, joint training с Cursor на real developer sessions, контекст 500K tokens, API $2/$6 за 1M input/output tokens.
- 16.07.2026: Moonshot AI выводит Kimi K3 как managed service; 26–27 июля публикует полные веса — 2,8T MoE, 1M context.
- 28.07.2026: Маск впервые публично описывает roadmap 4.6/4.7 в reply @rauchg. В тот же день 1200+ сотрудников OpenAI, Anthropic и др. подписывают open letter «Pacing the Frontier» с призывом замедлить автоматизированную разработку frontier-моделей.
- ~07.08.2026 (цель): Grok 4.6 — 1,5T параметров, фокус на SFT и RL, а не на чистом scale-up.
- конец августа — начало сентября (оценка): Grok 4.7 — 2,1T; Маск: «лучше 4.6 по всем метрикам, кроме inference latency; выше token efficiency».
Сроки Маска традиционно «плавают». До появления model card на x.ai/blog или console.x.ai любая дата — гипотеза, не production commitment.
02 Спецификация Grok-линейки и матрица frontier-конкурентов
| Модель | Дата / цель | Параметры | Фокус | Статус |
|---|---|---|---|---|
| Grok 4.3 Beta | 17.04.2026 | не раскрыто | baseline предыдущего поколения | released |
| Grok 4.5 | 08.07.2026 | не раскрыто (не MoE single SKU) | coding/agent, Cursor co-training | released |
| Grok 4.6 | ~07.08.2026 | 1,5T | масштабный SFT/RL post-training | анонс, не released |
| Grok 4.7 | ~конец авг. — нач. сент. | 2,1T | capability ↑, latency ↓ vs 4.6, token efficiency ↑ | анонс, не released |
Параметры, pricing и benchmark scores для 4.6/4.7 — заявления производителя без third-party verification. Строки «анонс» сверяйте с официальным release.
| Модель | Вендор | Параметры | Context window | Pricing (input/output, $/1M tokens) |
|---|---|---|---|---|
| Grok 4.5 | xAI | не раскрыто | 500K | $2 / $6 |
| Grok 4.6 (анонс) | xAI | 1,5T | не раскрыто | не раскрыто |
| Kimi K3 | Moonshot AI | 2,8T MoE (16/896 active experts) | 1M | $0,30 cache hit / $3 input, $15 output |
| Claude Fable 5.1 (слухи) | Anthropic | не раскрыто | не раскрыто | слухи: как Fable 5 ($10/$50) |
| GPT-5.6 Sol | OpenAI | не раскрыто | не раскрыто | не раскрыто |
Grok 4.6 и Fable 5.1 — preview/slухи; прямое сравнение benchmark'ов преждевременно. Таблица фиксирует release cadence и positioning, не quality ranking.
03 SFT и RL: почему апгрейд не сводится к «больше параметров»
Что делает SFT в production pipeline
Supervised Fine-Tuning подтягивает output distribution модели к curated dataset'ам: human-labeled trajectories, отфильтрованные agent sessions, code review patches. Маск явно указал, что Grok 4.6 усилен именно на SFT и RL слоях, а не только на pretrain scale. Это продолжение стратегии 4.5: joint training с Cursor на real developer sessions дал Terminal-Bench 2.1 — 83,3%, SWE-Bench Pro — 64,7% при ~15 954 output tokens на задачу против ~67 020 у Claude Opus 4.8 — разрыв 4,2× по token efficiency.
RLHF / RLVR в agent loop
Reinforcement learning с reward signal (task completion, test pass rate, linter clean) учит модель multi-step routing: tool call → parse → retry. Для coding-agent это критичнее raw FLOPs: agent loop на Grok API может крутиться часами; каждый лишний output token — прямой hit по billable units и latency tail.
Dual-SKU strategy: 4.6 vs 4.7
1,5T у 4.6 и 2,1T у 4.7 — явный split по latency/capability tradeoff. Маск признал, что 4.7 «медленнее на inference», но «token-efficient» — типичный pattern: fast tier для interactive IDE autocomplete, heavy tier для long-horizon refactors. Две модели вместо one-size-fits-all снижают risk переплаты за compute на простых запросах.
Давление Kimi K3 open weights
Grok 4.6 выходит ~10 дней после полного dump весов Kimi K3. K3 — 1679 pts на Frontend Code Arena (первый open-weight, обогнавший все closed models), #3 в Artificial Analysis Intelligence Index. Маск прокомментировал K3 benchmarks как «impressive». Ускорение xAI roadmap — прямой ответ на open-weight shock и параллельные релизы OpenAI/Anthropic.
Риски и неподтверждённые детали
- Single-source timeline: только reply Маска; xAI blog не синхронизирован.
- Benchmark/pricing vacuum: «1,5T» и «SFT/RL upgrade» — vendor claims без independent eval.
- Content safety litigation: в июле xAI подала иск против пользователя за обход guardrails и генерацию CSAM через Grok — первый такой case у компании. Отчёт Common Sense Media (январь 2026) ставил Grok among worst for minor safety.
- Расхождение с «Pacing the Frontier»: xAI не подписала open letter 28 июля; roadmap 4.6/4.7 вышел в тот же день.
Если сроки Маска сработают, Grok 4.6/4.7, слухи о Claude Fable 5.1 (~август) и уже released Kimi K3 сделают август 2026 одним из плотнейших месяцев frontier releases. Для engineering teams решающими станут token cost per solved task и routing flexibility, а не headline parameter count.
04 Шесть шагов подготовки инфраструктуры до релиза Grok 4.6
До публикации model card и pricing зафиксируйте baseline и routing slots — иначе release week превратится в reactive firefighting.
curl -s https://api.x.ai/v1/models \
-H "Authorization: Bearer $XAI_API_KEY" \
| jq '.data[].id'
Официальные источники; перепроверяйте после upstream update:
https://docs.x.ai/developers/models
Шесть шагов:
- Закрепить official channels: @xai на X, x.ai/blog, console.x.ai announcements. Reply Маска — secondary signal; production routing переключайте только по model card.
- Baseline cost на Grok 4.5: замерьте tokens/task и $/task на текущих agent workflows ($2/$6 per 1M). Это reference для оценки pricing shock 4.6.
- Обновить selection matrix: добавьте Kimi K3 (2,8T open weights), Fable 5.1 (rumor), GPT-5.6 Sol. Три оси: coding quality, context length, $/1M tokens.
- Pre-provision routing slot: в LiteLLM или Cursor model list зарезервируйте
grok-4.6alias; release day — swap model ID и A/B без redeploy gateway. - Release-day verification checklist: context window, SWE-Bench/Terminal-Bench scores, input/output pricing, Responses API cache support, rate limits.
- 7×24 agent node: long-horizon Grok agent loops и OpenClaw Gateway требуют always-on host. Sleep на локальном Mac рвёт API polling cycle; multi-репозиторий parallel agents конкурируют за CPU/GPU локальной машины — планируйте bare-metal cloud node заранее.
05 Цитируемые данные, FAQ и вывод
EEAT-якоря (с указанием источника):
- Grok 4.6 target scale: 1,5T параметров, акцент SFT/RL post-training (источник: reply Маска @rauchg, 28.07.2026; не verified model card).
- Grok 4.7 target scale: 2,1T; «лучше 4.6, медленнее inference, выше token efficiency» (источник: тот же reply; ETA конец авг. — нач. сент.).
- Grok 4.5 token efficiency reference: SWE-Bench Pro ~15 954 output tokens vs Opus 4.8 ~67 020 — 4,2× gap (источник: xAI Grok 4.5 model card, 08.07.2026).
FAQ:
- Точная дата релиза Grok 4.6? Маск сказал «примерно 7 августа» — неформально, без official confirmation от xAI. Фактический релиз может сдвинуться.
- Чем 4.6 отличается от 4.7? 4.6 — 1,5T, SFT/RL focus; 4.7 — 2,1T, через «несколько недель» после 4.6, выше capability и token efficiency, ниже inference speed.
- 4.6 сильнее Kimi K3 или Fable 5.1? Сказать нельзя: у 4.6 нет public benchmarks; K3 имеет measured scores; Fable 5.1 не confirmed Anthropic.
- Ожидаемый pricing 4.6? Не объявлен. Ориентир — Grok 4.5 ($2/$6 per 1M), но next-gen pricing может отличаться.
- Где получить доступ? По аналогии с 4.5: вероятно Grok Build, xAI API, console.x.ai первыми; third-party integrations — позже. Ждите official announcement.
Вывод: Grok 4.6 — сигнал ускорения xAI после Kimi K3 open-weight shock. Dual-track «scale + post-training polish» стоит мониторить, но любая performance-оценка до model card — unverified. Августовый cluster release сжимает selection window: cost baseline и routing framework важнее погони за parameter headline.
Дополнительные первичные источники:
https://github.com/moonshotai/Kimi-K3
Grok agent workflow на локальном Mac даёт три structural failure mode: sleep interrupt длинных API loops, contention при parallel work в нескольких репозиториях, отсутствие 24/7 uptime для OpenClaw Gateway. Для production Cursor Agent, Grok Build или multi-repo CI с AI routing аренда bare-metal Mac Mini у CALMVPS — типично оптимальный fit: dedicated Apple Silicon, native Metal, month-to-month billing, delivery ~120 секунд, тяжёлые agent cycles на изолированном physical node, локально — только review. Цены аренды Mac Mini M4.