2026 年 7 月 28 日、Elon Musk 氏は X 上で Vercel CEO Guillermo Rauch への返信の中で、xAI が 8 月 7 日前後に 1.5T パラメータの Grok 4.6 をリリースし、数週間後に 2.1T の Grok 4.7 が続くと述べました。本記事は LLM リリース動向とコーディング Agent 選定に関心のある開発者向けに、Grok 4.5→4.6→4.7 タイムライン、コアスペックと競合比較表、SFT/RL 後学習の意味、4 つの論点、2026 年 8 月の集中リリース背景、6 ステップの事前評価チェックリスト、FAQを網羅します。現時点の情報は Musk 氏の X 投稿 1 件が中心で、公式モデルカードや第三者ベンチマークはありません。リリース前は必ず xAI 公式チャネルで確認してください。
Grok 4.5 からわずか 1 か月で 2 つの大型モデルが予告されました。Cursor/Grok コーディングワークフローを評価中のチームにとって、選定ウィンドウは極めて短いことを意味します。以下は確認済みイベントと公式予告の整理です。
| 日付 | イベント |
|---|---|
| 2026-07-08 | xAI が Grok 4.5 を正式リリース。コーディングと Agentic 向け、Cursor 共同学習、50 万 Token コンテキスト、$2/$6 per 1M Token |
| 2026-07-16 | Moonshot AI の Kimi K3 がホスト型サービスとして提供開始 |
| 2026-07-26 | Kimi K3 が 1 日早く完全オープンウェイトを公開(2.8T、100 万 Token コンテキスト) |
| 2026-07-28 | Musk 氏が @rauchg への返信で Grok 4.6/4.7 ロードマップを初公開——本記事の主要情報源 |
| 約 2026-08-07 | Grok 4.6 予定、1.5T、SFT/RL 強化が中心 |
| 約 2026-08 末–9 月初 | Grok 4.7 予定、2.1T。4.6 を全面的に上回るが推論はやや遅く Token 効率は向上(Musk 氏) |
ツイートを公式発表と混同:Musk 氏のスケジュールは「Musk time」として知られるように、数日から 2 週間遅れることがあります
パラメータ数≠能力:4.6 は SFT/RL 重視で、4.7 はより大きいが遅い——2 SKU で役割分担
競合ウィンドウが極短:Kimi K3 オープンウェイト衝撃の約 10 日後に Grok 4.6 予告、8 月には Claude Fable 5.1 噂も
ベンチマーク空白:Grok 4.5 リリース時の詳細モデルカードと異なり、4.6 には独立評価がゼロ
料金未公表:4.5 の $2/$6 のみ参考、次世代は変更の可能性
安全・コンプライアンス:7 月の CSAM 深偽訴訟など、ベンダーリスク評価に組み込む必要があります
Musk time 注意:予告より数日から 2 週間遅れることは珍しくありません。xAI 公式アカウントまたは Web サイトの告知を優先し、本記事を正式スペックの約束と見なさないでください。
| モデル | 日付/目標 | パラメータ | 重点 | 状態 |
|---|---|---|---|---|
| Grok 4.3 Beta | 2026-04-17 | 非公開 | 前世代ベースライン | リリース済 |
| Grok 4.5 | 2026-07-08 | 非公開(MoE ではない単一 SKU) | コーディング/Agentic、Cursor 共同学習 | リリース済 |
| Grok 4.6 | 約 2026-08-07 | 1.5T | SFT/RL 大幅強化 | 予告のみ、未リリース |
| Grok 4.7 | 約 2026-08 末–9 月初 | 2.1T | 4.6 全面向上、Token 効率向上 | 予告のみ、未リリース |
注:パラメータ、料金、ベンチマークはベンダー/Musk 氏の発言ベース。Grok 4.6/4.7 に第三者評価はありません。
| モデル | ベンダー | パラメータ | コンテキスト | 料金(入/出 per 1M) | 出典 |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | 非公開 | 500K | $2 / $6 | xAI 公式 |
| Grok 4.6(予告) | xAI | 1.5T | 非公開 | 非公開 | Musk X 投稿(未検証) |
| Kimi K3 | Moonshot AI | 2.8T(MoE、約 16/896 エキスパート) | 1M | $0.30(キャッシュヒット)/$3 入力、$15 出力 | Moonshot + Hugging Face |
| Claude Fable 5.1(噂) | Anthropic | 非公開 | 非公開 | Fable 5 据え置き噂($10/$50) | 36kr、WinCentral リーク、Anthropic 未確認 |
| GPT-5.6 Sol | OpenAI | 非公開 | 非公開 | 非公開 | OpenAI 公式 |
Grok 4.6 と Claude Fable 5.1 の行は予告・噂であり、正式ベンチマーク比較ではありません。開発者にとって Token 効率と実タスクコストの方が、パラメータ規模より追跡価値が高いです。
教師あり微調整(SFT)は高品質な出力例でモデルの振る舞いを整え、強化学習(RL)は報酬信号で多段 Agent タスクの正しい行動系列を学ばせます。Musk 氏は 4.6 の重点を「significantly improved SFT & RL」と明示しました。Grok 4.5 は Cursor の実開発者セッションで Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% を達成し、同等タスクの出力 Token は約 1.9 万(Claude Opus 4.8 の約 6.7 万より大幅に少ない)です。
4.6 の 1.5T は 4.5 より明確な規模増ですが、4.7 は 2.1T で「推論はやや遅い」と Musk 氏自身が認めています。xAI は「最強」と「最速」を別 SKU で分ける方針を示唆しています。
Grok 4.6 の目標日は Kimi K3 完全オープンウェイト公開の約 10 日後です。Kimi K3 は Frontend Code Arena で 1679 点、Artificial Analysis Intelligence Index 世界 3 位。Musk 氏も「印象的」とコメント。xAI が 4.6/4.7 のペースを加速した背景として、OpenAI・Anthropic・中国勢との競争激化が最も説明力があります。
情報源を固定:x.ai/news と @xai を追跡。二次報道だけで調達判断しない
ベースライン記録:現行 Grok 4.5 の Token 消費と合格率を 4.6 A/B 用に保存
予算バッファ:4.5 の $2/$6 で上限試算し、Kimi K3・GPT-5.6 Sol 等の代替ルートを準備
4.6 vs 4.7 の使い分け:レイテンシ重視は 4.6、最高品質許容は 4.7 を待つ
コンプライアンス審査:CSAM 訴訟と Common Sense Media の児童安全評価を企業方針に反映
接続経路の準備:Grok Build、xAI API、Cursor 等の day-one 告知を優先確認
業界分裂の背景:減速を求める声とリリース加速が同時進行——2026 年 8 月は LLM リリース密度が最高の月の一つになり得ます。コストパフォーマンスと Token 効率が、パラメータやリーダーボード単独より実務的な判断軸です。
Musk 氏のタイムラインが成立すれば、Grok 4.6・4.7 は噂の Claude Fable 5.1(36kr、WinCentral 等が 8 月、OpenAI GPT-6 前を狙うと報じる)と同月に登場し、7 月オープンウェイト化した Kimi K3 の衝撃も重なります。2026 年 8 月の選定ウィンドウは極めて短く、Token 効率と実コストが持続的な選定基準になります。
Grok 4.6 を Cursor 系の長セッション Agent や iOS CI に組み込む場合、ノート PC や不安定な Linux VPS 上の CLI Agent はメモリ不足・セッション切断・Xcode/Metal ツールチェーン欠如に直面しがちです。安定 SSH 長セッション、DerivedData キャッシュ、iOS CI/CD 自動化が必要な本番環境では、NodeMini の Mac Mini クラウドレンタルが通常より適した選択です。詳細は Mac Mini レンタル料金をご覧ください。
情報は 2026 年 7 月 30 日時点。出典:xAI Grok 4.5 公式、Musk 2026-07-28 X 投稿、Moonshot Kimi K3、36kr/WinCentral(Fable 5.1 噂)、The Verge/TechTimes(Pacing the Frontier)、Ars Technica/TechCrunch(xAI 安全論争)。
Musk 氏は「8 月 7 日前後」と述べましたが、xAI による公式確認はありません。リリース後の接続環境は Mac Mini レンタル料金も参考にしてください。
Grok 4.6 は 1.5T で SFT/RL 後学習強化。Grok 4.7 は 2.1T で数週間後、4.6 を全面的に上回るが推論はやや遅く Token 効率はさらに高い(Musk 氏)。
現時点では判断できません。Grok 4.6 には公開ベンチマークがなく、Kimi K3 は検証済みスコアがあり、Fable 5.1 は Anthropic 未確認です。
未公表です。Grok 4.5 の $2/$6(100 万 Token 入出力)は参考値ですが、次世代では変更される可能性があります。正式情報を優先してください。
Grok 4.5 の展開から、Grok Build、xAI API、コンソールが先行する見込みです。運用の詳細は ヘルプセンターをご参照ください。