7 月 28 日、イーロン・マスクは X 上で Vercel CEO Guillermo Rauch への返信の中で、xAI が8 月 7 日前後にパラメータ規模1.5 兆の Grok 4.6 を公開し、数週間後には 2.1 兆パラメータの Grok 4.7 も続くと述べました。前モデル Grok 4.5 からわずか 1 か月で、xAI は 2026 年夏に 3 つのフロンティアモデルを連続投入する計画を示しています。
本記事はAgent プログラミングツールの選定や xAI ロードマップを追う技術チーム向けです。マスクの公開発言と業界報道に基づき、タイムライン、パラメータ比較、論点を整理し、未確認情報を明示します。読了後、Grok 4.6/4.7 の位置づけ、Kimi K3 との競合関係、公開前に取るべき選定準備が把握できます。
01 Grok 4.5 から 4.6・4.7 へ:どれほど速いロードマップか
公開前に押さえるべき痛点:
- 情報源が単一:Grok 4.6/4.7 の詳細は現時点でマスクの X 返信 1 件のみ。xAI 公式ブログは未同期です。
- 「Musk time」のゆらぎ:マスクのスケジュールは数日到 2 週間程度後ろ倒しになることが多く、「約 8 月 7 日」を確約と見なすべきではありません。
- 競合のペースが選定窓を圧縮:Kimi K3 が 7 月 26 日に完全オープンウェイト公開され、Grok 4.6 目標は約 10 日後。前世代フラッグシップが立ち上がったばかりで次世代が迫る状況です。
- ベンチマークと料金が空白:Grok 4.5 公開時の詳細なモデルカードと異なり、4.6 には第三者評価が一切ありません。
- 2026 年 7 月 8 日:xAI が Grok 4.5 を正式リリース。プログラミングと Agent タスク特化のフラッグシップ。Cursor との共同トレーニング、実開発者セッションデータ使用、50 万 token コンテキスト、入力 $2/出力 $6(100 万 token あたり)。
- 2026 年 7 月 16 日:競合 Moonshot AI の Kimi K3 がマネージドサービスとして登場。7 月 26 日に 1 日早く完全オープンウェイト公開。2.8 兆パラメータ、100 万 token コンテキスト。
- 2026 年 7 月 28 日:マスクが Rauch への返信で Grok 4.6/4.7 のロードマップと概ねの時期を初公開。本記事の主要情報源です。同日、OpenAI・Anthropic 等 1200 名超の従業員が「Pacing the Frontier」公開書簡に連署し、フロンティア AI 開発の意図的なペースダウンを求めました。
- 2026 年 8 月 7 日前後(目標):Grok 4.6 公開予定。1.5 兆パラメータ。SFT(教師あり微調整)と RL(強化学習)の大幅強化が焦点で、単純なパラメータ増ではありません。
- 2026 年 8 月末〜9 月初旬(見込み):Grok 4.7 が続く見込み。2.1 兆パラメータ。マスクは「推論速度はやや遅いが 4.6 を全面的に上回り、token 効率も高い」と述べています。
マスクのスケジュールには歴史的にゆらぎがあり、業界では「Musk time」と呼ばれます。実際の公開日が予告より数日から 2 週間遅れることは珍しくありません。公開前は xAI 公式アカウントまたは公式サイトの告知を優先してください。
02 コアデータ一覧と横断競合比較
| モデル | 公開/目標時期 | パラメータ規模 | 位置づけ | 状態 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026 年 4 月 17 日 | 未公開 | 前世代ベースライン | 公開済み |
| Grok 4.5 | 2026 年 7 月 8 日 | 未公開(非 MoE 単一 SKU) | プログラミング・Agent、Cursor 共同トレーニング | 公開済み |
| Grok 4.6 | 約 2026 年 8 月 7 日 | 1.5 兆 | SFT/RL 大幅強化 | 公式予告、未公開 |
| Grok 4.7 | 約 8 月末〜9 月初旬 | 2.1 兆 | 4.6 を全面上回る、token 効率向上 | 公式予告、未公開 |
注:パラメータ規模、料金、ベンチマークスコアはベンダー/マスク本人の発言に基づきます。Grok 4.6 と 4.7 には第三者独立評価がなく、表中「公式予告」情報は正式リリース内容で必ず再確認してください。
| モデル | ベンダー | パラメータ規模 | コンテキスト | 料金(入力/出力、100 万 token) |
|---|---|---|---|---|
| Grok 4.5 | xAI | 未公開 | 50 万 token | $2 / $6 |
| Grok 4.6(予告) | xAI | 1.5 兆 | 未公開 | 未公開 |
| Kimi K3 | 月之暗面 | 2.8 兆(MoE、896 中 16 エキスパート活性化) | 100 万 token | $0.30(キャッシュヒット)/$3 入力、$15 出力 |
| Claude Fable 5.1(噂) | Anthropic | 未公開 | 未公開 | 噂は Fable 5 料金維持($10/$50) |
| GPT-5.6 Sol | OpenAI | 未公開 | 未公開 | 未公開 |
表中 Grok 4.6、Claude Fable 5.1 のデータは予告または噂に基づき、正式ベンチマーク比較にはなりません。公開ペースとおおまかな位置づけの参考としてご利用ください。
03 深掘り:今回の強化は「より大きい」より「より学習効率が高い」
SFT と RL が解く課題
教師あり微調整(SFT)は、人手アノテーションまたは厳選された高品質サンプルでモデルの出力習慣を矯正します。強化学習(RL)は報酬信号を通じて、多段階 Agent タスクなど実タスクチェーンで「正しい行動」を学ばせます。マスクは Grok 4.6 の強化焦点がパラメータ規模そのものではなく「SFT & RL」にあると明言しました。これは Grok 4.5 の方針の延長です。Grok 4.5 は Cursor との共同トレーニングで実開発者セッションデータを活用し、出力 token 消費を抑えつつ Terminal-Bench 2.1 で 83.3%、SWE-Bench Pro で 64.7% を記録しました。同種タスクの出力 token は Claude Opus 4.8 の約 1.9 万 token に対し Grok 4.5 は約 6.7 万 token より大幅に少ないと xAI は主張しています。
xAI が「パラメータ増量 + ポストトレーニング精修」の二刀流を選ぶ理由
Grok 4.6 の 1.5 兆パラメータは Grok 4.5 から明確な規模ジャンプです。一方、マスクは「パラメータだけが変数ではない」とも述べ、Grok 4.7 は 2.1 兆で「推論はやや遅い」と補足しました。xAI 内部では規模と速度のトレードオフを認識しており、「より強い」と「より速い」を別 SKU で満たす二モデル戦略を示唆しています。
Kimi K3 との同期競争がもたらす現実的圧力
Grok 4.6 の公開目標は Kimi K3 完全オープンウェイト公開から約 10 日後です。Kimi K3 は Frontend Code Arena プログラミングランキングで 1679 点、全クローズドモデルを上回る初のオープンモデルとして 1 位を獲得し、Artificial Analysis インテリジェンス指数で世界 3 位でした。マスク本人も Kimi K3 関連評価に「印象的」とコメントしています。業界では、xAI が Grok 4.6/4.7 の投入ペースを加速した背景に OpenAI、Anthropic、中国ベンダーとの競争激化があると広く解釈されています。
論点と注意すべき細部
- スケジュールは第三者未検証:唯一の情報源はマスクの X 返信 1 件。xAI 公式ブログと製品ページは未更新です。
- ベンチマークと料金はすべて空白:「1.5 兆パラメータ」「SFT/RL 大幅強化」は現時点でベンダー単独の主張です。
- xAI のコンテンツ安全に関する最近の論争:7 月、xAI はユーザー 1 名を提訴し、Grok の安全制限を迂回して CSAM を生成したと主張しました。AI 生成ディープフェイクに関する xAI 初のユーザー訴訟です。2026 年 1 月、Common Sense Media の報告書は Grok を「未成年保護で最も劣る AI 製品の一つ」と評価しました。
- 業界「減速」呼びかけとのずれ:7 月 28 日のロードマップ公開と同日、「Pacing the Frontier」公開書簡が OpenAI と Anthropic 従業員の支持を得ましたが、xAI は署名者に含まれていません。
マスクのスケジュールが通れば、Grok 4.6 と Grok 4.7 は噂の Claude Fable 5.1(36kr、WinCentral 等の複数ソースが 8 月を示唆)と同月に登場する可能性があります。7 月の Kimi K3 オープンウェイトショックと重なり、2026 年 8 月は大規模言語モデル公開密度が最も高い月の一つになる見込みです。開発者と企業ユーザーにとって、パラメータ規模やベンチマーク単独より、コストパフォーマンスと token 効率が実務的な判断軸になります。
04 Grok 4.6 公開前の 6 ステップ実装準備
Grok 4.6 のモデルカードと料金が正式公開される前に、インフラと選定フレームを整えておくと、公開週の受動的な追従を避けられます。
curl -s https://api.x.ai/v1/models \
-H "Authorization: Bearer $XAI_API_KEY" \
| jq '.data[].id'
以下が主要な公式ソースです。リリースやページ更新後はリンクを再確認してください。
https://docs.x.ai/developers/models
6 ステップ実装準備:
- 公式情報源を固定する:xAI 公式 X(@xai)、x.ai/blog、console.x.ai の告知を監視します。マスク個人の発言は参考程度とし、xAI 正式モデルカードを正とします。
- Grok 4.5 コスト基線を構築する:現在の Agent ワークフローで Grok 4.5 のタスクあたり token 消費とドルコスト($2/$6 参照)を集計し、4.6 の値上げ・値下げ比較の土台にします。
- 競合選定マトリクスを更新する:Kimi K3(2.8T オープンウェイト)、Claude Fable 5.1(噂)、GPT-5.6 Sol を同一表に載せ、プログラミング、長コンテキスト、料金の 3 軸で評価します。
- Cursor / Grok Build にルート枠を確保する:LiteLLM または Cursor モデル一覧に
grok-4.6スロットを予約し、公開当日は model ID 変更だけで A/B テストできるようにします。 - 公開日検証チェックリストを用意する:モデルカード入手後、コンテキスト長、SWE-Bench/Terminal-Bench スコア、入出力料金、Responses API キャッシュ対応を項目ごとに確認します。
- 7×24 Agent インフラを計画する:長時間プログラミング Agent と OpenClaw Gateway は常時稼働ノードが必要です。ローカル Mac のスリープは Grok API 長ループを中断するため、クラウドベアメタル案を事前に検討します。
05 引用可能データ、FAQ、まとめ
引用可能な主要データ(EEAT):
- Grok 4.6 目標パラメータ:1.5 兆、SFT/RL ポストトレーニング強化が焦点(出典:マスク 2026-07-28 X 返信 @rauchg、xAI 公式モデルカード未確認)。
- Grok 4.7 目標パラメータ:2.1 兆、4.6 を全面上回るが推論やや遅く token 効率は向上(出典:同上、8 月末〜9 月初旬見込み)。
- Grok 4.5 token 効率参照:SWE-Bench Pro 単回出力約 15,954 token vs Opus 4.8 約 67,020 token、約 4.2 倍差(出典:xAI Grok 4.5 モデルカード、2026-07-08)。
よくある質問 FAQ:
- Q:Grok 4.6 は具体的にいつリリースされますか? A:マスクは「約 8 月 7 日」と述べましたが、非公式発言であり xAI 公式確認ではありません。実際の時期は前後する可能性があります。
- Q:Grok 4.6 と Grok 4.7 の違いは? A:Grok 4.6 は 1.5 兆パラメータで SFT/RL 強化が中心です。Grok 4.7 は 2.1 兆パラメータで 4.6 公開後「数週間」で追随予定。マスクは能力は 4.6 を上回るが推論速度はやや遅く token 効率は高いと述べています。
- Q:Grok 4.6 は Kimi K3 や Claude Fable 5.1 より強いですか? A:現時点では判断できません。Grok 4.6 には公開ベンチマークがなく、Kimi K3 は実測データがあり一部プログラミングランキングで突出、Claude Fable 5.1 は Anthropic 公式未確認のため三者直接比較は不可能です。
- Q:Grok 4.6 の料金はどの程度になりそうですか? A:公式未発表です。Grok 4.5(入力 $2/出力 $6、100 万 token)をおおまかな参考にできますが、新世代は調整される可能性があるため正式情報を待ってください。
- Q:一般ユーザーはどこで Grok 4.6 を使えるようになりますか? A:Grok 4.5 の配布経路から推測すると、Grok Build、xAI 公式 API、コンソールが先行し、その後サードパーティ連携が拡大する可能性があります。具体入口は正式発表を確認してください。
まとめ:Grok 4.6 は Kimi K3 オープンウェイトショック後の xAI 加速迭代のシグナルです。1.5 兆パラメータと SFT/RL 精修の二軸戦略は追う価値がありますが、公式モデルカード公開前の性能判断はすべて「未確認」とラベル付けすべきです。8 月の集中公開は選定窓を極端に短くするため、コスト基線とルーティング枠組みを先に整える方が、パラメータ数字を追うより実務的です。
以下が主要ソースです。リリースやページ更新後はリンクを再確認してください。
https://github.com/moonshotai/Kimi-K3
個人 Mac 上で Grok Agent ワークフローを走らせると、スリープによる長ループ中断、複数リポジトリ並列によるローカルリソース争奪、7×24 常駐の困難が残ります。Cursor Agent、Grok Build、OpenClaw Gateway の安定稼働が必要な本番環境では、CALMVPS ベアメタル Mac Mini レンタルが通常より適しています。Apple Silicon 専有、Metal ネイティブ加速、月次柔軟契約、約 120 秒デプロイで重 Agent ループをクラウドにオフロードし、ローカルはレビューに集中できます。詳細は料金ページをご覧ください。