Grok 4.6 什麼時候發布?
馬斯克預告 8 月 7 日上線,參數升至 1.5 萬億

馬斯克 7 月 28 日在 X 上回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於8 月 7 日前後發布參數規模達1.5 兆Grok 4.6,隨後數週內還會推出 2.1 兆參數的 Grok 4.7。這距離上一代 Grok 4.5 發布僅一個月,意味著 xAI 在今年夏天要連續推出三款前沿模型。

本文面向正在評估 Agent 程式設計工具、關注 xAI 路線圖的技術團隊,嚴格依據馬斯克公開表態與業界報導整理時間軸、參數對照與爭議點,並明確標註未證實資訊。讀完後你將釐清:Grok 4.6/4.7 各自定位、與 Kimi K3 的競爭關係,以及發布前該如何做選型準備。

01 從 Grok 4.5 到 4.6、4.7:時間軸有多快?

發布前的真實痛點:

  • 資訊來源單一:目前 Grok 4.6/4.7 細節僅來自馬斯克一則 X 回覆,xAI 官方部落格尚未同步公告。
  • 「Musk time」彈性:馬斯克歷史時間表常延後數天至兩週,不能把「約 8 月 7 日」當硬承諾。
  • 競品節奏壓縮選型視窗:Kimi K3 7 月 26 日全面開源後,Grok 4.6 目標發布僅隔約 10 天,上一代旗艦可能剛上線就要面對新一代。
  • 基準與定價全空白:與 Grok 4.5 發布時詳盡的模型卡不同,4.6 目前沒有任何獨立測評佐證。
  • 2026 年 7 月 8 日:xAI 正式發布 Grok 4.5,定位為「專為程式設計與智慧代理任務打造」的旗艦模型,與 Cursor 合作、使用真實開發者工作階段資料訓練,支援 50 萬 token 上下文,定價為每百萬 token 輸入 $2 / 輸出 $6。
  • 2026 年 7 月 16 日:競品 Moonshot AI 的 Kimi K3 以託管服務形式上線,隨後在 7 月 26 日提前一天釋出完整開源權重,2.8 兆參數、100 萬 token 上下文。
  • 2026 年 7 月 28 日:馬斯克在回覆 Rauch 的貼文中首次公開 Grok 4.6 和 4.7 的路線圖與大致時間表——這也是本文資訊的主要來源。同一天,OpenAI、Anthropic 等公司 1200 餘名員工聯署「Pacing the Frontier」公開信,呼籲建立主動放緩前沿 AI 發展的治理工具。
  • 2026 年 8 月 7 日前後(目標):Grok 4.6 計畫發布,1.5 兆參數,重點在 SFT(監督微調)和 RL(強化學習)層面的升級,而非單純堆參數。
  • 2026 年 8 月末至 9 月初(預估):Grok 4.7 計畫跟進,2.1 兆參數,馬斯克稱其「除了推理速度稍慢外,其他方面全面優於 4.6,且 token 效率更高」。

需要提醒的是,馬斯克給出的時間表歷來存在彈性——業界常稱之為「Musk time」,實際發布日期比預告晚幾天到兩週並不罕見,發布前建議以 xAI 官方帳號或官網公告為準。

02 核心資料一覽與橫向競品對照

Grok 系列路線圖(截至 2026-07-30)
模型 發布/目標時間 參數規模 定位重點 狀態
Grok 4.3 Beta 2026 年 4 月 17 日 未公開 上一代基線 已發布
Grok 4.5 2026 年 7 月 8 日 未公開(非 MoE 單一 SKU) 程式設計與智慧代理任務,與 Cursor 聯合訓練 已發布
Grok 4.6 約 2026 年 8 月 7 日 1.5 兆 SFT/RL 大幅升級 官方預告,未發布
Grok 4.7 約 8 月末-9 月初 2.1 兆 全面優於 4.6,token 效率更高 官方預告,未發布

註:參數規模、定價、基準分數均為廠商/馬斯克自述,Grok 4.6 與 4.7 目前均未有第三方獨立評測資料,表中「官方預告」資訊務必以正式發布為準。

Grok 系列 vs 同期競品
模型 廠商 參數規模 上下文視窗 定價(輸入/輸出,每百萬 token)
Grok 4.5 xAI 未公開 50 萬 token $2 / $6
Grok 4.6(預告) xAI 1.5 兆 未公開 未公開
Kimi K3 月之暗面 2.8 兆(MoE,啟用約 16/896 專家) 100 萬 token $0.30(快取命中)/$3 輸入,$15 輸出
Claude Fable 5.1(傳聞) Anthropic 未公開 未公開 傳聞維持 Fable 5 定價($10/$50)
GPT-5.6 Sol OpenAI 未公開 未公開 未公開

表格中 Grok 4.6、Claude Fable 5.1 相關資料均為預告或傳聞,不構成正式基準對照,僅供參考發布節奏和大致定位。

03 深度拆解:這次升級的重點不是「更大」,而是「更會學」

SFT 和 RL 到底在解決什麼問題

監督微調(SFT)是用人工標註或精選的高品質樣本去糾正模型的輸出習慣;強化學習(RL)則是用獎勵訊號讓模型在真實任務鏈路中學會「怎麼做才對」,尤其是多步驟的智慧代理任務。馬斯克特意強調 Grok 4.6 的升級重點在「SFT & RL」而非參數規模本身,這與 Grok 4.5 的打法是延續的——Grok 4.5 當時憑藉與 Cursor 合作取得的真實開發者工作階段資料,在保持較小輸出 token 消耗的情況下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成績,處理同類任務所用的輸出 token 數量遠低於 Claude Opus 4.8(約 1.9 萬 token 對 6.7 萬 token)。

為什麼 xAI 選擇「參數堆量 + 後訓練精修」兩條路並行

Grok 4.6 的 1.5 兆參數相比 Grok 4.5 是明顯的規模躍升,但馬斯克沒有迴避「參數不是唯一變數」這一點——他隨後補充說 Grok 4.7 會更大(2.1 兆)卻「推理稍慢」,暗示 xAI 內部很清楚參數規模和推理速度之間存在權衡,未來會用兩款不同定位的模型分別滿足「更強」和「更快」的需求,而不是用一個模型通吃所有場景。

與 Kimi K3 同期競爭帶來的現實壓力

Grok 4.6 的發布時間表恰好卡在 Kimi K3 全面開源引發業界震動之後的第 10 天左右。Kimi K3 在 Frontend Code Arena 程式設計榜單上以 1679 分登頂,成為首個超越所有閉源模型的開源模型,Artificial Analysis 智慧指數綜合排名全球第三。馬斯克本人也在 Kimi K3 相關評測下留言稱「令人印象深刻」。業界普遍解讀,xAI 加快 Grok 4.6/4.7 發布節奏,與 OpenAI、Anthropic 及中國廠商的競爭烈度上升直接相關。

爭議點與需要注意的細節

  • 時間表本身未經第三方驗證:目前唯一資訊來源是馬斯克在 X 上的一則回覆貼,xAI 官方部落格和產品頁尚未同步公告。
  • 基準分數與定價全部空白:「1.5 兆參數」和「SFT/RL 大幅升級」目前都是廠商單方面說法。
  • xAI 近期的內容安全爭議:7 月 xAI 對一名使用者提起訴訟,指控其利用 Grok 繞過安全限制生成 CSAM,這也是 xAI 首次就 AI 生成的深度偽造內容起訴使用者。今年 1 月,Common Sense Media 的報告曾將 Grok 評為「未成年人保護最差的 AI 產品之一」。
  • 與業界「減速」呼籲的錯位:7 月 28 日馬斯克發布路線圖同一天,「Pacing the Frontier」公開信獲 OpenAI 與 Anthropic 公司背書,xAI 未出現在簽署名單中。

如果馬斯克的時間表成立,Grok 4.6、Grok 4.7 將與傳聞中的 Claude Fable 5.1(據 36kr、WinCentral 等多方爆料指向 8 月)在同一個月內相繼登場,疊加 7 月已經開源的 Kimi K3 帶來的衝擊,2026 年 8 月很可能成為大模型發布密度最高的月份之一。對開發者和企業使用者而言,性價比和 token 效率(而非單純的參數規模或跑分)會是更實際的決策依據。

04 Grok 4.6 發布前怎麼做?六步落地準備

在 Grok 4.6 正式公布模型卡與定價之前,工程團隊可以先將基礎設施與選型框架搭好,避免發布當週被動追熱點。

grok-watchlist.sh
curl -s https://api.x.ai/v1/models \
  -H "Authorization: Bearer $XAI_API_KEY" \
  | jq '.data[].id'

以下為主要官方來源,發版或頁面更新後請再次開啟連結核對:

https://x.ai/news/grok-4-5

https://docs.x.ai/developers/models

六步落地準備:

  1. 鎖定官方資訊來源:關注 xAI 官方 X 帳號(@xai)、x.ai/blog 與 console.x.ai 公告頁;馬斯克個人表態僅作參考,以 xAI 正式模型卡為準。
  2. 建立 Grok 4.5 成本基線:統計目前 Agent 工作流在 Grok 4.5 上的每任務 Token 消耗與美元成本(參考 $2/$6 定價),為 4.6 漲價或降價留出對照空間。
  3. 更新競品選型矩陣:將 Kimi K3(2.8T 開放權重)、Claude Fable 5.1(傳聞)、GPT-5.6 Sol 納入同一張對照表,按程式設計、長上下文、定價三維度評分。
  4. 在 Cursor / Grok Build 預留路由位:在 LiteLLM 或 Cursor 模型列表中預留 grok-4.6 槽位,發布當日只需改 model ID 即可 A/B 測試。
  5. 制定發布日驗證清單:模型卡到手後逐項核對——上下文視窗、SWE-Bench/Terminal-Bench 分數、輸入輸出定價、是否支援 Responses API 快取。
  6. 準備 7×24 Agent 基礎設施:長時程式設計 Agent 與 OpenClaw Gateway 需要不休眠的常駐節點;本機 Mac 休眠會中斷 Grok API 長迴圈,提前規劃雲端裸金屬方案。

05 可引用資料、FAQ 與總結

可引用關鍵資料(EEAT):

  • Grok 4.6 目標參數:1.5 兆,重點 SFT/RL 後訓練升級(來源:馬斯克 2026-07-28 X 回覆 @rauchg,未經 xAI 官方模型卡驗證)。
  • Grok 4.7 目標參數:2.1 兆,馬斯克稱其全面優於 4.6 但推理稍慢、token 效率更高(來源:同上,預估 8 月末至 9 月初)。
  • Grok 4.5 Token 效率參照:SWE-Bench Pro 單次輸出約 15,954 token vs Opus 4.8 約 67,020 token,差距 4.2×(來源:xAI Grok 4.5 模型卡,2026-07-08)。

常見問題 FAQ:

  • Q:Grok 4.6 具體是哪天發布? A:馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期,實際時間可能提前或延後。
  • Q:Grok 4.6 和 Grok 4.7 有什麼區別? A:Grok 4.6 為 1.5 兆參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 兆參數,預計在 4.6 發布後「數週」跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。
  • Q:Grok 4.6 會比 Kimi K3 或 Claude Fable 5.1 更強嗎? A:目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測資料且在部分程式設計榜單上表現突出,Claude Fable 5.1 本身尚未被 Anthropic 官方確認發布,三者暫無法直接對照。
  • Q:Grok 4.6 大概會怎麼定價? A:官方未公布。可參考 Grok 4.5 的定價(輸入 $2/輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整,務必以正式發布資訊為準。
  • Q:一般使用者屆時能在哪裡用上 Grok 4.6? A:按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入更多第三方平台,但具體入口以正式發布公告為準。

總結:Grok 4.6 是 xAI 在 Kimi K3 開源衝擊後加速迭代的訊號——1.5 兆參數 + SFT/RL 精修的雙軌策略值得追蹤,但在官方模型卡落地前,任何效能判斷都應標註「未證實」。8 月扎堆發布意味著選型視窗極短,提前搭好成本基線與路由框架比追逐參數數字更務實。

以下為主要來源,發版或頁面更新後請再次開啟連結核對:

https://x.ai/news/grok-4-5

https://kimi.com/blog/kimi-k3

https://github.com/moonshotai/Kimi-K3

把 Grok Agent 工作流跑在個人 Mac 上仍有硬傷:休眠中斷長迴圈、多儲存庫並行搶佔本機資源、難以 7×24 常駐。對於需要 Cursor Agent、Grok Build 或 OpenClaw Gateway 穩定運行的生產環境,CALMVPS 裸金屬 Mac Mini 租賃通常是更優解:獨佔 Apple Silicon、Metal 原生加速、按月彈性下單,約 120 秒交付,將重 Agent 迴圈卸載雲端而本機僅做審核。詳見 定價頁