Grok 4.6 什麼時候發布?
馬斯克預告 8 月 7 日上線,參數升至 1.5 萬億

馬斯克 7 月 28 日在 X 上回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發布參數規模達 1.5 萬億Grok 4.6,隨後幾週內還會推出 2.1 萬億參數的 Grok 4.7。本文面向關注大模型發布節奏程式設計 Agent 選型的開發者,完整涵蓋:Grok 4.5→4.6→4.7 時間線核心參數與競品對比表SFT/RL 後訓練升級解析四大爭議點2026 年 8 月扎堆發布背景六步發布前評估清單FAQ。核心提醒:目前資訊均來自馬斯克單條 X 回覆,尚無官方模型卡或第三方基準,發布前務必以 xAI 官方管道核實。

01

從 Grok 4.5 到 4.6、4.7:xAI 今年夏天要連推三款前沿模型,節奏有多快?

距離上一代 Grok 4.5 發布僅一個月,xAI 就預告了兩款更大模型——這對正在評估 Cursor/Grok 程式設計工作流的團隊意味著極短的選型窗口期。以下時間線梳理已確認事件與官方預告。

日期事件
2026-07-08xAI 正式發布 Grok 4.5,定位為程式設計與智慧代理旗艦,與 Cursor 合作、使用真實開發者工作階段資料訓練,50 萬 token 上下文,定價 $2/$6 每百萬 token
2026-07-16月之暗面 Kimi K3 以託管服務形式上線
2026-07-26Kimi K3 提前一天放出完整開源權重,2.8 萬億參數、100 萬 token 上下文
2026-07-28馬斯克在回覆 @rauchg 的貼文中首次公開 Grok 4.6/4.7 路線圖——本文主要資訊來源
約 2026-08-07Grok 4.6 計畫發布,1.5 萬億參數,重點 SFT/RL 升級
約 2026-08 末–9 月初Grok 4.7 計畫跟進,2.1 萬億參數,馬斯克稱其全面優於 4.6 但推理稍慢、token 效率更高

開發者最該警惕的三個「資訊陷阱」

  1. 01

    把推文當官方公告:馬斯克時間表歷來存在彈性(業內稱「Musk time」),實際可能晚幾天到兩週

  2. 02

    參數規模≠能力:4.6 強調 SFT/RL 而非單純堆參數,4.7 更大卻更慢——兩款 SKU 定位不同

  3. 03

    競品窗口極短:Kimi K3 開源衝擊後僅約 10 天即預告 Grok 4.6,8 月還可能撞上 Claude Fable 5.1 傳聞

  4. 04

    基準分數空白:與 Grok 4.5 發布時詳細模型卡不同,4.6 目前零獨立測評

  5. 05

    定價未公布:只能參考 4.5 的 $2/$6,新一代可能調整

  6. 06

    安全合規背景:xAI 7 月就 CSAM 深度偽造起訴使用者,企業選型須納入供應商風險評估

warning

Musk time 提醒:馬斯克給出的時間表歷來存在彈性,實際發布日期比預告晚幾天到兩週並不罕見。發布前建議以 xAI 官方帳號或官網公告為準,勿將本文當作正式規格承諾。

02

Grok 系列核心資料與橫向競品對比:哪些能信、哪些還不能?

Grok 系列演進一覽

模型發布/目標時間參數規模定位重點狀態
Grok 4.3 Beta2026-04-17未公開上一代基線已發布
Grok 4.52026-07-08未公開(非 MoE 單一 SKU)程式設計與智慧代理,與 Cursor 聯合訓練已發布
Grok 4.6約 2026-08-071.5 萬億SFT/RL 大幅升級官方預告,未發布
Grok 4.7約 2026-08 末–9 月初2.1 萬億全面優於 4.6,token 效率更高官方預告,未發布

註:參數規模、定價、基準分數均為廠商/馬斯克自述,Grok 4.6 與 4.7 目前均未有第三方獨立評測資料。

同期競品橫向對比

模型廠商參數規模上下文定價(輸入/輸出,每百萬 token)資料來源
Grok 4.5xAI未公開50 萬 token$2 / $6xAI 官方
Grok 4.6(預告)xAI1.5 萬億未公開未公開馬斯克 X 貼文(未經第三方驗證)
Kimi K3月之暗面2.8 萬億(MoE,啟用約 16/896 專家)100 萬 token$0.30(快取命中)/$3 輸入,$15 輸出Moonshot + Hugging Face
Claude Fable 5.1(傳聞)Anthropic未公開未公開傳聞維持 Fable 5($10/$50)36kr、WinCentral 爆料,未確認
GPT-5.6 SolOpenAI未公開未公開未公開OpenAI 官方

表格中 Grok 4.6、Claude Fable 5.1 相關資料均為預告或傳聞,不構成正式基準對比——對開發者而言,token 效率與真實任務成本比參數規模更值得追蹤。

03

這次升級的重點不是「更大」,而是「更會學」:SFT 與 RL 到底在解決什麼?

SFT 和 RL 在 Grok 4.6 中的角色

監督微調(SFT)用人工標註或精選高品質樣本糾正模型輸出習慣;強化學習(RL)用獎勵訊號讓模型在真實任務鏈路中學會「怎麼做才對」,尤其是多步驟智慧代理任務。馬斯克特意強調 Grok 4.6 升級重點在「SFT & RL」而非參數規模本身,這與 Grok 4.5 打法延續——4.5 憑藉與 Cursor 合作取得的真實開發者工作階段資料,在保持較小輸出 token 消耗的情況下拿到 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%,處理同類任務輸出 token 約 1.9 萬,遠低於 Claude Opus 4.8 的約 6.7 萬

為什麼 xAI 選擇「參數堆量 + 後訓練精修」兩條腿走路

Grok 4.6 的 1.5 萬億參數相比 4.5 是明顯規模躍升,但馬斯克沒有回避「參數不是唯一變數」——他隨後補充 Grok 4.7 會更大(2.1 萬億)卻「推理稍慢」,暗示 xAI 內部清楚參數規模與推理速度之間存在權衡,未來用兩款不同定位模型分別滿足「更強」和「更快」,而非一個模型通吃所有場景。

與 Kimi K3 同期競爭帶來的現實壓力

Grok 4.6 發布時間表卡在 Kimi K3 全面開源引發業界震動後約第 10 天。Kimi K3 在 Frontend Code Arena 程式設計榜單以 1679 分登頂,成為首個超越所有閉源模型的開源模型,Artificial Analysis 智慧指數綜合排名全球第三。馬斯克本人也在 Kimi K3 相關評測下留言稱「令人印象深刻」。業內普遍解讀,xAI 加快 Grok 4.6/4.7 發布節奏,與 OpenAI、Anthropic 及中國廠商競爭烈度上升直接相關。

發布前六步評估清單(落地操作)

  1. 01

    鎖定資訊來源:關注 xAI 官方部落格(x.ai/news)與 @xai 帳號,勿僅憑二手媒體報導做採購決策

  2. 02

    建立基準對照:記錄目前 Grok 4.5 在你團隊真實任務上的 token 消耗與通過率,作為 4.6 上線後的 A/B 基線

  3. 03

    預留預算緩衝:按 4.5 定價 $2/$6 估算上限,同時準備 Kimi K3、GPT-5.6 Sol 等備選路由

  4. 04

    區分 4.6 vs 4.7:延遲敏感場景優先等 4.6;追求極致能力且可接受更慢推理的可觀望 4.7

  5. 05

    審查合規風險:評估 xAI 近期 CSAM 訴訟與 Common Sense Media 未成年人保護評級對企業政策的影響

  6. 06

    準備接入路徑:按 Grok 4.5 經驗,優先檢查 Grok Build、xAI API 與 Cursor 等第三方平台的 day-one 公告

04

爭議點與需要注意的細節:單一資訊來源、安全訴訟與業界「減速」呼籲

  • 時間表未經第三方驗證:目前唯一資訊來源是馬斯克在 X 上的一條回覆,xAI 官方部落格和產品頁尚未同步公告
  • 基準分數與定價全部空白:與 Grok 4.5 發布時詳細模型卡不同,4.6 目前沒有任何獨立測評佐證,「1.5 萬億參數」和「SFT/RL 大幅升級」均為廠商單方面說法
  • xAI 內容安全爭議:7 月 xAI 起訴一名使用者利用 Grok 繞過安全限制生成 CSAM,係公司首次就 AI 生成深度偽造內容起訴使用者;今年 1 月 Common Sense Media 報告將 Grok 評為「未成年人保護最差的 AI 產品之一」
  • 與業界「減速」呼籲的錯位:7 月 28 日——馬斯克發布 Grok 4.6/4.7 路線圖同一天,OpenAI、Anthropic 等公司 1200 餘名員工聯署「Pacing the Frontier」公開信,呼籲美國政府建立主動放緩前沿 AI 發展的治理工具;xAI 未出現在簽署名單中
info

業界分裂背景:一邊呼籲減速、一邊壓縮發布節奏——2026 年 8 月很可能成為大模型發布密度最高的月份之一。對團隊而言,性價比和 token 效率比單純參數規模或跑分更是實際決策依據。

05

2026 年 8 月會是「扎堆發布月」:可引用資料與對開發者的影響

如果馬斯克時間表成立,Grok 4.6、Grok 4.7 將與傳聞中的 Claude Fable 5.1(據 36kr、WinCentral 等多方爆料指向 8 月,且 Anthropic 意圖搶在 OpenAI GPT-6 之前上線)在同一個月內相繼登場,疊加 7 月已開源的 Kimi K3 衝擊,2026 年 8 月選型窗口期極短——上一代旗艦可能剛上線一個月就要面對新一代競品。

可引用關鍵資料速查

  • Grok 4.6 預告:約 8 月 7 日、1.5 萬億參數、SFT/RL 重點升級(馬斯克 X 回覆 @rauchg,未獨立驗證)
  • Grok 4.7 預告:約 8 月末–9 月初、2.1 萬億參數、全面優於 4.6 但推理稍慢、token 效率更高
  • Grok 4.5 已發布基準:Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%;輸出 token 約 1.9 萬/任務 vs Opus 4.8 約 6.7 萬
  • Kimi K3 對照:2.8T 參數、Frontend Code Arena 1679 分、AA Index 全球第三
  • Grok 4.5 定價參考:輸入 $2/輸出 $6 每百萬 token,50 萬 token 上下文

若你計畫將 Grok 4.6 接入 Cursor 類長工作階段編碼 Agent 或 iOS CI 流水線,在筆電或不穩定 Linux VPS上跑 CLI Agent 常面臨記憶體不足、工作階段中斷與 Xcode/Metal 工具鏈缺失。對於需要穩定 SSH 長工作階段、DerivedData 快取與 iOS CI/CD 自動化的生產環境,NodeMini 的 Mac Mini 雲端租賃通常是更優解——獨佔節點、秒級撥備,讓 Agent 與建置任務在同一台真實 Mac 上持續執行。詳見 Mac Mini 租賃價格

以上資訊截至 2026 年 7 月 30 日。資料來源:xAI Grok 4.5 官方公告與模型卡、馬斯克 2026-07-28 X 貼文、Moonshot Kimi K3 官方發布、36kr/WinCentral 關於 Claude Fable 5.1 傳聞、The Verge/TechTimes 關於 Pacing the Frontier 公開信、Ars Technica/TechCrunch 關於 xAI 安全爭議報導。

FAQ

常見問題

馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期,實際時間可能提前或延後。上線後接入環境可參考 Mac Mini 租賃價格

Grok 4.6 為 1.5 萬億參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 萬億參數,預計在 4.6 發布後「幾週」跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。

目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測資料且在部分程式設計榜單上表現突出,Claude Fable 5.1 本身尚未被 Anthropic 官方確認發布,三者暫無法直接對比。

官方未公布。可參考 Grok 4.5 的定價(輸入 $2/輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整,務必以正式發布資訊為準。

按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入更多第三方平台。更多維運問題見 說明中心