若你正在評估 2026 年夏末的前沿模型 API 選型,Grok 4.6 的時間表值得單獨盯一眼:馬斯克 7 月 28 日在 X 上回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發佈參數規模達 1.5 萬億的 Grok 4.6,隨後幾週內還會推出 2.1 萬億參數的 Grok 4.7——但 xAI 官方尚未公布基準分數與定價。本文按時間線、核心資料、SFT/RL 升級邏輯、競品對比與爭議點五個維度整理,並明確標註哪些仍是「馬斯克一句話」級別的未證實資訊。

為什麼開發者此刻應該關心 Grok 4.6 時間表

這起發佈預告看似只是巨頭公關,但對一線工程團隊有三層直接影響:

  • 選型窗口被壓縮:Grok 4.5 7 月 8 日才上線,若 8 月 7 日 Grok 4.6 跟進,旗艦模型的「有效貨架期」可能只有一個月——與 7 月 Hugging Face 入侵與 GPT-6 監管賽跑疊加後,多模型編排的成本模型需要按月重算。
  • 資訊來源極度單一:目前 Grok 4.6/4.7 的參數規模、SFT/RL 升級幅度均來自馬斯克一則 X 回覆,沒有 accompanying 模型卡——這與 Grok 4.5 發佈時 15 項基準齊發的做法形成反差,整合前必須預留「日期滑移 + 規格變更」緩衝。
  • 開源衝擊已落地:Kimi K3 7 月 26 日全面開源 2.8 萬億權重後,Frontend Code Arena 程式設計榜單 1679 分登頂;xAI 若按 Musk time 節奏連推三款前沿模型,競爭焦點會從「參數規模」轉向 token 效率與 Agent 後訓練品質。

先說邊界:下文 Grok 4.6/4.7 的日期與參數來自馬斯克 7 月 28 日 X 貼文,xAI 官方部落格與產品頁尚未同步公告。業內所稱「Musk time」意味著實際發佈可能比預告晚幾天到兩週——發佈前請以 xAI 官方渠道為準。

時間線:從 Grok 4.5 到 4.6、4.7,節奏有多快

日期事件
2026 年 7 月 8 日xAI 正式發佈 Grok 4.5,定位為程式設計與智慧體任務旗艦,與 Cursor 合作、使用真實開發者會話資料訓練,50 萬 token 上下文,定價每百萬 token 輸入 2 美元/輸出 6 美元
2026 年 7 月 16 日Moonshot AI 的 Kimi K3 以託管服務形式上線
2026 年 7 月 26 日Kimi K3 提前一天放出完整開源權重,2.8 萬億參數、100 萬 token 上下文
2026 年 7 月 28 日馬斯克在回覆 Rauch 的貼文中首次公開 Grok 4.6 和 4.7 路線圖與大致時間表;同日 OpenAI、Anthropic 等 1200 餘名員工聯署「Pacing the Frontier」公開信
約 2026 年 8 月 7 日(目標)Grok 4.6 計畫發佈,1.5 萬億參數,重點在 SFT 與 RL 層面升級
約 2026 年 8 月末至 9 月初(預估)Grok 4.7 計畫跟進,2.1 萬億參數,馬斯克稱其除推理速度稍慢外全面優於 4.6,且 token 效率更高

核心資料一覽與競品橫向對比

下表彙總 Grok 系列與同期競品已知規格;Grok 4.6、Claude Fable 5.1 相關行均為預告或傳聞,不構成正式基準對比。

模型發佈/目標時間參數規模上下文定價(輸入/輸出,每百萬 token)狀態
Grok 4.52026 年 7 月 8 日未公開50 萬 token$2 / $6已發佈
Grok 4.6(預告)約 8 月 7 日1.5 萬億未公開未公開官方預告,未發佈
Grok 4.7(預告)約 8 月末–9 月初2.1 萬億未公開未公開官方預告,未發佈
Kimi K32026 年 7 月 26 日開源2.8 萬億(MoE)100 萬 token$0.30(快取命中)/$3(未命中)輸入,$15 輸出已發佈
Claude Fable 5.1(傳聞)傳聞 8 月未公開未公開傳聞維持 Fable 5($10/$50)Anthropic 未確認
GPT-5.6 Sol已發佈未公開未公開未公開已發佈

深度拆解:升級重點不是「更大」,而是「更會學」

監督微調(SFT)用人工標註或精選高品質樣本糾正模型輸出習慣;強化學習(RL)用獎勵訊號讓模型在多步驟智慧體任務中學會正確動作序列。馬斯克強調 Grok 4.6 的升級重點在「SFT & RL」而非單純堆參數——這與 Grok 4.5 的打法延續:Grok 4.5 憑藉與 Cursor 合作的真實開發者會話後訓練,在 Terminal-Bench 2.1 拿到 83.3%、SWE-Bench Pro 64.7%,處理同類任務輸出 token 約 1.9 萬,遠低於 Claude Opus 4.8 的約 6.7 萬。

Grok 4.6 的 1.5 萬億參數是明顯規模躍升,但馬斯克對 Grok 4.7 的表述——更大(2.1 萬億)卻「推理稍慢」——暗示 xAI 會用兩款不同定位的 SKU 分別滿足「更強」與「更快」,而非一個模型通吃所有場景。Grok 4.6 目標日期落在 Kimi K3 全面開源約 10 天後;馬斯克曾在 Kimi K3 評測帖下留言稱「令人印象深刻」,業內普遍解讀 xAI 加快節奏與 OpenAI、Anthropic 及中國廠商競爭烈度上升直接相關。

發佈前開發者可執行的五步核對清單

在 Grok 4.6 正式模型卡落地前,建議按以下步驟管理整合風險,避免把「預告參數」寫進生產依賴:

  1. 鎖定資訊源層級:將馬斯克 X 貼文標記為「方向性預告」,Grok 4.5 官方模型卡與 xAI 新聞稿標記為「已驗證基線」,二者不可混用於 SLA 或成本測算。
  2. 設定日期緩衝:按「Musk time」慣例在 8 月 7 日目標上額外預留 7–14 天滑移窗口,關鍵發佈路徑準備 Grok 4.5 或 Kimi K3 回退方案。
  3. 重算 token 效率而非只看跑分:Grok 4.5 的優勢在 Agent 任務輸出 token 更少;若 4.6 延續此路徑,API 帳單可能比「智商指數更高但輸出更長」的模型更省——需等官方披露 per-task token 資料後再定。
  4. 隔離評測環境:新模型預覽期常在共享沙箱或本機跑基準,狀態污染與憑證殘留風險上升;敏感 Agent 鏈路應在可重置的隔離硬體上驗證。
  5. 追蹤 8 月扎堆發佈:傳聞 Claude Fable 5.1 亦指向 8 月,與 Grok 4.6/4.7 同月登場時,對比評測應固定同一 prompt 集與同一硬體環境,避免跨週結果不可比。

爭議點與需要注意的細節

  • 時間表未經第三方驗證:唯一資訊來源是馬斯克 X 回覆,xAI 官方尚未同步公告,日期可能提前或推遲。
  • 基準分數與定價全部空白:與 Grok 4.5 發佈時詳細模型卡不同,Grok 4.6 目前無獨立測評或官方模型卡佐證能力。
  • xAI 內容安全爭議:7 月 xAI 起訴一名使用者涉嫌利用 Grok 繞過安全限制生成 CSAM,係公司首次就 AI 生成深度偽造內容起訴使用者;Common Sense Media 1 月報告曾將 Grok 評為未成年人保護最差的 AI 產品之一——不影響技術能力評價,但涉及企業安全合規投入。
  • 與行業「減速」呼籲的錯位:7 月 28 日馬斯克發佈路線圖同日,OpenAI 與 Anthropic 以公司名義背書「Pacing the Frontier」公開信;xAI 未出現在簽署名單,「一邊呼籲減速、一邊加速迭代」的行業分裂值得持續觀察。

可引用核心資料與來源

  • Grok 4.6 目標日期:約 2026 年 8 月 7 日——馬斯克 7 月 28 日 X 回覆 @rauchg,非 xAI 官方公告。
  • Grok 4.6 參數規模:1.5 萬億——同上單一社群貼文來源,未經第三方驗證。
  • Grok 4.5 定價:每百萬 token 輸入 $2、輸出 $6;上下文 50 萬 token——xAI 官方《Introducing Grok 4.5》與模型卡。
  • Grok 4.5 Agent 基準:Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%;輸出 token 效率優於 Opus 4.8——xAI 模型卡與第三方整理(eesel.ai、felloai.com 等)。

參數、定價與基準分數可能隨正式發佈調整,請以官方頁面為準。以下為可核驗來源:

xAI 官方部落格《Introducing Grok 4.5》

xAI Grok 4.5 官方模型卡(media.x.ai)

Moonshot AI Kimi K3 開源儲存庫(GitHub)

The Verge(Pacing the Frontier 公開信報導)

常見問題

Grok 4.6 具體是哪天發佈?

馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發佈日期,實際時間可能提前或延後。

Grok 4.6 和 Grok 4.7 有什麼區別?

Grok 4.6 為 1.5 萬億參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 萬億參數,預計在 4.6 發佈後幾週跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。

Grok 4.6 會比 Kimi K3 或 Claude Fable 5.1 更強嗎?

目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測資料且在部分程式設計榜單表現突出,Claude Fable 5.1 本身尚未被 Anthropic 官方確認發佈,三者暫無法直接對比。

Grok 4.6 大概會怎麼定價?

官方未公布。可參考 Grok 4.5 的定價(輸入 $2/輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整,務必以正式發佈資訊為準。

一般使用者屆時能在哪裡用上 Grok 4.6?

按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入更多第三方平台,但具體入口以正式發佈公告為準。

前沿模型發佈密度越來越高,本機或共享環境裡跑多模型 Agent 評測的狀態污染、憑證殘留和意外橫向移動風險也在上升——每次換模型都重裝環境既費時又難復現。若你需要一台可隨時重置、整機獨享、支援 SSH 與 VNC 雙通道接入的 Apple Silicon 實體主機來隔離 Grok 與開源模型的對比測試,VMSPIN 按天起租的雲端 Mac mini通常是更穩妥的落點;長期算力成本可參考購機 vs 租賃盈虧平衡試算。Grok 4.6 是否按 8 月 7 日落地仍是未知數,但你的實驗環境不必跟著賭時間表。