馬斯克 7 月 28 日在 X 上回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發布參數規模達 1.5 萬億的 Grok 4.6,隨後幾週內還會推出 2.1 萬億參數的 Grok 4.7。本文面向關注大模型發布節奏與程式設計 Agent 選型的開發者,完整涵蓋:Grok 4.5→4.6→4.7 時間線、核心參數與競品對比表、SFT/RL 後訓練升級解析、四大爭議點、2026 年 8 月扎堆發布背景、六步發布前評估清單與 FAQ。核心提醒:目前資訊均來自馬斯克單條 X 回覆,尚無官方模型卡或第三方基準,發布前務必以 xAI 官方管道核實。
距離上一代 Grok 4.5 發布僅一個月,xAI 就預告了兩款更大模型——這對正在評估 Cursor/Grok 程式設計工作流的團隊意味著極短的選型窗口期。以下時間線梳理已確認事件與官方預告。
| 日期 | 事件 |
|---|---|
| 2026-07-08 | xAI 正式發布 Grok 4.5,定位為程式設計與智慧代理旗艦,與 Cursor 合作、使用真實開發者工作階段資料訓練,50 萬 token 上下文,定價 $2/$6 每百萬 token |
| 2026-07-16 | 月之暗面 Kimi K3 以託管服務形式上線 |
| 2026-07-26 | Kimi K3 提前一天放出完整開源權重,2.8 萬億參數、100 萬 token 上下文 |
| 2026-07-28 | 馬斯克在回覆 @rauchg 的貼文中首次公開 Grok 4.6/4.7 路線圖——本文主要資訊來源 |
| 約 2026-08-07 | Grok 4.6 計畫發布,1.5 萬億參數,重點 SFT/RL 升級 |
| 約 2026-08 末–9 月初 | Grok 4.7 計畫跟進,2.1 萬億參數,馬斯克稱其全面優於 4.6 但推理稍慢、token 效率更高 |
把推文當官方公告:馬斯克時間表歷來存在彈性(業內稱「Musk time」),實際可能晚幾天到兩週
參數規模≠能力:4.6 強調 SFT/RL 而非單純堆參數,4.7 更大卻更慢——兩款 SKU 定位不同
競品窗口極短:Kimi K3 開源衝擊後僅約 10 天即預告 Grok 4.6,8 月還可能撞上 Claude Fable 5.1 傳聞
基準分數空白:與 Grok 4.5 發布時詳細模型卡不同,4.6 目前零獨立測評
定價未公布:只能參考 4.5 的 $2/$6,新一代可能調整
安全合規背景:xAI 7 月就 CSAM 深度偽造起訴使用者,企業選型須納入供應商風險評估
Musk time 提醒:馬斯克給出的時間表歷來存在彈性,實際發布日期比預告晚幾天到兩週並不罕見。發布前建議以 xAI 官方帳號或官網公告為準,勿將本文當作正式規格承諾。
| 模型 | 發布/目標時間 | 參數規模 | 定位重點 | 狀態 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026-04-17 | 未公開 | 上一代基線 | 已發布 |
| Grok 4.5 | 2026-07-08 | 未公開(非 MoE 單一 SKU) | 程式設計與智慧代理,與 Cursor 聯合訓練 | 已發布 |
| Grok 4.6 | 約 2026-08-07 | 1.5 萬億 | SFT/RL 大幅升級 | 官方預告,未發布 |
| Grok 4.7 | 約 2026-08 末–9 月初 | 2.1 萬億 | 全面優於 4.6,token 效率更高 | 官方預告,未發布 |
註:參數規模、定價、基準分數均為廠商/馬斯克自述,Grok 4.6 與 4.7 目前均未有第三方獨立評測資料。
| 模型 | 廠商 | 參數規模 | 上下文 | 定價(輸入/輸出,每百萬 token) | 資料來源 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 未公開 | 50 萬 token | $2 / $6 | xAI 官方 |
| Grok 4.6(預告) | xAI | 1.5 萬億 | 未公開 | 未公開 | 馬斯克 X 貼文(未經第三方驗證) |
| Kimi K3 | 月之暗面 | 2.8 萬億(MoE,啟用約 16/896 專家) | 100 萬 token | $0.30(快取命中)/$3 輸入,$15 輸出 | Moonshot + Hugging Face |
| Claude Fable 5.1(傳聞) | Anthropic | 未公開 | 未公開 | 傳聞維持 Fable 5($10/$50) | 36kr、WinCentral 爆料,未確認 |
| GPT-5.6 Sol | OpenAI | 未公開 | 未公開 | 未公開 | OpenAI 官方 |
表格中 Grok 4.6、Claude Fable 5.1 相關資料均為預告或傳聞,不構成正式基準對比——對開發者而言,token 效率與真實任務成本比參數規模更值得追蹤。
監督微調(SFT)用人工標註或精選高品質樣本糾正模型輸出習慣;強化學習(RL)用獎勵訊號讓模型在真實任務鏈路中學會「怎麼做才對」,尤其是多步驟智慧代理任務。馬斯克特意強調 Grok 4.6 升級重點在「SFT & RL」而非參數規模本身,這與 Grok 4.5 打法延續——4.5 憑藉與 Cursor 合作取得的真實開發者工作階段資料,在保持較小輸出 token 消耗的情況下拿到 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7%,處理同類任務輸出 token 約 1.9 萬,遠低於 Claude Opus 4.8 的約 6.7 萬。
Grok 4.6 的 1.5 萬億參數相比 4.5 是明顯規模躍升,但馬斯克沒有回避「參數不是唯一變數」——他隨後補充 Grok 4.7 會更大(2.1 萬億)卻「推理稍慢」,暗示 xAI 內部清楚參數規模與推理速度之間存在權衡,未來用兩款不同定位模型分別滿足「更強」和「更快」,而非一個模型通吃所有場景。
Grok 4.6 發布時間表卡在 Kimi K3 全面開源引發業界震動後約第 10 天。Kimi K3 在 Frontend Code Arena 程式設計榜單以 1679 分登頂,成為首個超越所有閉源模型的開源模型,Artificial Analysis 智慧指數綜合排名全球第三。馬斯克本人也在 Kimi K3 相關評測下留言稱「令人印象深刻」。業內普遍解讀,xAI 加快 Grok 4.6/4.7 發布節奏,與 OpenAI、Anthropic 及中國廠商競爭烈度上升直接相關。
鎖定資訊來源:關注 xAI 官方部落格(x.ai/news)與 @xai 帳號,勿僅憑二手媒體報導做採購決策
建立基準對照:記錄目前 Grok 4.5 在你團隊真實任務上的 token 消耗與通過率,作為 4.6 上線後的 A/B 基線
預留預算緩衝:按 4.5 定價 $2/$6 估算上限,同時準備 Kimi K3、GPT-5.6 Sol 等備選路由
區分 4.6 vs 4.7:延遲敏感場景優先等 4.6;追求極致能力且可接受更慢推理的可觀望 4.7
審查合規風險:評估 xAI 近期 CSAM 訴訟與 Common Sense Media 未成年人保護評級對企業政策的影響
準備接入路徑:按 Grok 4.5 經驗,優先檢查 Grok Build、xAI API 與 Cursor 等第三方平台的 day-one 公告
業界分裂背景:一邊呼籲減速、一邊壓縮發布節奏——2026 年 8 月很可能成為大模型發布密度最高的月份之一。對團隊而言,性價比和 token 效率比單純參數規模或跑分更是實際決策依據。
如果馬斯克時間表成立,Grok 4.6、Grok 4.7 將與傳聞中的 Claude Fable 5.1(據 36kr、WinCentral 等多方爆料指向 8 月,且 Anthropic 意圖搶在 OpenAI GPT-6 之前上線)在同一個月內相繼登場,疊加 7 月已開源的 Kimi K3 衝擊,2026 年 8 月選型窗口期極短——上一代旗艦可能剛上線一個月就要面對新一代競品。
若你計畫將 Grok 4.6 接入 Cursor 類長工作階段編碼 Agent 或 iOS CI 流水線,在筆電或不穩定 Linux VPS上跑 CLI Agent 常面臨記憶體不足、工作階段中斷與 Xcode/Metal 工具鏈缺失。對於需要穩定 SSH 長工作階段、DerivedData 快取與 iOS CI/CD 自動化的生產環境,NodeMini 的 Mac Mini 雲端租賃通常是更優解——獨佔節點、秒級撥備,讓 Agent 與建置任務在同一台真實 Mac 上持續執行。詳見 Mac Mini 租賃價格。
以上資訊截至 2026 年 7 月 30 日。資料來源:xAI Grok 4.5 官方公告與模型卡、馬斯克 2026-07-28 X 貼文、Moonshot Kimi K3 官方發布、36kr/WinCentral 關於 Claude Fable 5.1 傳聞、The Verge/TechTimes 關於 Pacing the Frontier 公開信、Ars Technica/TechCrunch 關於 xAI 安全爭議報導。
馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期,實際時間可能提前或延後。上線後接入環境可參考 Mac Mini 租賃價格。
Grok 4.6 為 1.5 萬億參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 萬億參數,預計在 4.6 發布後「幾週」跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。
目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測資料且在部分程式設計榜單上表現突出,Claude Fable 5.1 本身尚未被 Anthropic 官方確認發布,三者暫無法直接對比。
官方未公布。可參考 Grok 4.5 的定價(輸入 $2/輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整,務必以正式發布資訊為準。
按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入更多第三方平台。更多維運問題見 說明中心。