Am 28. Juli 2026 teilte Elon Musk Vercel-CEO Guillermo Rauch auf X mit, dass xAI Grok 4.6 um den 7. August mit 1,5 Billionen Parametern veröffentlichen wird, gefolgt wenige Wochen später von Grok 4.7 mit 2,1 Billionen Parametern. Für Entwickler und IT-Leiter, die Frontier-Modell-Releases und Coding-Agent-Auswahl verfolgen, deckt dieser Artikel die Zeitlinie Grok 4.5 bis 4.7, Spezifikations- und Wettbewerbsvergleichstabellen, SFT/RL-Nachtraining, vier Warnsignale, den August-2026-Release-Engpass, eine Sechs-Schritte-Bewertungsliste und 5 FAQ ab. Kernhinweis: Alle Angaben stammen aus einer einzigen X-Antwort — kein offizielles Model Card oder Drittanbieter-Benchmark. Vor Beschaffungsentscheidungen unbedingt xAI-Kanäle prüfen; bei EU-Einsatz auch DSGVO- und Anbieter-Risikobewertung einbeziehen.
Nur einen Monat nach Grok 4.5 kündigt xAI bereits zwei größere Modelle an — für Teams, die Cursor/Grok-Agent-Workflows evaluieren, bleibt ein extrem kurzes Auswahlfenster. Die folgende Zeitlinie trennt bestätigte Ereignisse von offiziellen Vorschauen.
| Datum | Ereignis |
|---|---|
| 2026-07-08 | xAI veröffentlicht Grok 4.5 als Coding- und Agentic-Flaggschiff, gemeinsam mit Cursor auf echten Entwicklersitzungen trainiert. 500K-Token-Kontext, Preise 2 USD/6 USD pro Million Tokens, veröffentlichte Model Card mit 15 Benchmarks. |
| 2026-07-16 | Moonshot AIs Kimi K3 geht als gehosteter Dienst live |
| 2026-07-26 | Kimi K3 veröffentlicht Open-Weight-Gewichte einen Tag früher — 2,8 Billionen Parameter, 1 Mio. Token Kontext |
| 2026-07-28 | Musk postet Grok-4.6/4.7-Roadmap als Antwort auf @rauchg — Hauptquelle dieses Artikels |
| ~2026-08-07 | Grok 4.6 Zieltermin — 1,5 Billionen Parameter, Fokus SFT/RL-Upgrade |
| ~Ende Aug.–Anfang Sep. 2026 | Grok 4.7 geplant — 2,1 Billionen Parameter; laut Musk in fast allen Bereichen besser als 4.6, bei etwas langsamerer Inferenz und höherer Token-Effizienz |
Tweet als offizielle Ankündigung werten: Musk-Zeitpläne verschieben sich historisch um Tage bis zwei Wochen
Parameterzahl ist nicht gleich Leistung: 4.6 betont SFT/RL, 4.7 ist größer aber langsamer — zwei SKUs, zwei Kompromisse
Wettbewerbsfenster extrem eng: Grok 4.6 wurde ca. 10 Tage nach Kimi K3 Open-Weight-Schock angekündigt; im August drohen Claude-Fable-5.1-Gerüchte
Benchmark-Daten fehlen: Im Gegensatz zur detaillierten Grok-4.5-Model-Card gibt es für 4.6 null unabhängige Tests
Preise unbekannt: Grok 4.5s 2 USD/6 USD dient nur als Referenz — Next-Gen-Preise können abweichen
Anbieter-Risiko und DSGVO: xAIs CSAM-Klage im Juli und Common-Sense-Media-Bewertung gehören in die Lieferantenbewertung; bei Verarbeitung personenbezogener Prompt-Daten in der EU ist die DSGVO-konforme Datenverarbeitung zu prüfen
Musk-Time-Hinweis: Musk-Zeitpläne verschieben sich regelmäßig um Tage bis Wochen. Behandeln Sie „ca. 7. August" als Ziel, nicht als Garantie. Bestätigen Sie über xAIs offiziellen Blog oder @xai, bevor Sie diese Angaben als Spezifikation behandeln.
| Modell | Datum | Parameter | Schwerpunkt | Status |
|---|---|---|---|---|
| Grok 4.3 Beta | 17. Apr. 2026 | Nicht veröffentlicht | Vorgänger-Baseline | Veröffentlicht |
| Grok 4.5 | 8. Jul. 2026 | Nicht veröffentlicht (Single SKU, kein MoE) | Coding/Agentic, mit Cursor co-trainiert | Veröffentlicht, benchmarked |
| Grok 4.6 | ~7. Aug. 2026 | 1,5 Billionen | SFT/RL-Upgrade | Per Tweet angekündigt, unveröffentlicht |
| Grok 4.7 | ~Ende Aug.–Anfang Sep. 2026 | 2,1 Billionen | Umfassendes Upgrade gegenüber 4.6, bessere Token-Effizienz | Per Tweet angekündigt, unveröffentlicht |
Hinweis: Parameterzahlen, Preise und Benchmarks sind Hersteller-/Musk-Angaben. Grok 4.6 und 4.7 haben noch keine Drittanbieter-Evaluierungen.
| Modell | Anbieter | Parameter | Kontext | Preis (Eingabe/Ausgabe pro 1 Mio. Tokens) | Quelle |
|---|---|---|---|---|---|
| Grok 4.5 | xAI | Nicht veröffentlicht | 500K | 2 USD / 6 USD | xAI offiziell |
| Grok 4.6 (angekündigt) | xAI | 1,5 Billionen | Nicht veröffentlicht | Nicht veröffentlicht | Musks X-Post (unverifiziert) |
| Kimi K3 | Moonshot AI | 2,8 Billionen (MoE, ~16/896 Experten aktiv) | 1 Mio. | 0,30 USD (Cache Hit) / 3 USD Eingabe, 15 USD Ausgabe | Moonshot + Hugging Face |
| Claude Fable 5.1 (Gerücht) | Anthropic | Nicht veröffentlicht | Nicht veröffentlicht | Gerücht: unverändert zu Fable 5 (10 USD / 50 USD) | 36kr, WinCentral — unbestätigt |
| GPT-5.6 Sol | OpenAI | Nicht veröffentlicht | Nicht veröffentlicht | Nicht veröffentlicht | OpenAI offiziell |
Grok 4.6 und Claude Fable 5.1 sind Vorab-Angaben, keine verifizierten Benchmarks — nützlich für Release-Timing und Positionierung, nicht für direkte Leistungsvergleiche. Für Entwickler zählen Token-Effizienz und realer Task-Kosten statt reiner Parameterzahl.
Supervised Fine-Tuning (SFT) formt Modellverhalten mit kuratierten Beispiel-Ausgaben; Reinforcement Learning (RL) nutzt Belohnungssignale, um wirksame Aktionssequenzen zu lernen — entscheidend für mehrstufige Agentic-Tasks. Musk betonte „signifikant verbessertes SFT & RL" statt reiner Skalierung, in Fortführung der Grok-4.5-Strategie: Echte Cursor-Entwicklersitzungen halfen Grok 4.5 zu Terminal-Bench 2.1 83,3 % und SWE-Bench Pro 64,7 % bei ca. 15.954 Ausgabe-Tokens pro Task gegenüber Opus 4.8s 67.020 — ein 4,2-facher Effizienzvorsprung.
Grok 4.6s Sprung auf 1,5 Billionen Parameter ist ein echter Skalierungsschritt, aber Musks Einordnung von Grok 4.7 — größer bei 2,1 Billionen, „besser in fast allem außer etwas langsamerer Inferenz" — deutet auf zwei bewusst unterschiedlich positionierte SKUs hin, analog zu Anthropics Sonnet/Opus-Split oder OpenAIs Mini/Full-Tiers.
Grok 4.6s Zieltermin liegt ca. 10 Tage nach Kimi K3s vollständiger Open-Weight-Veröffentlichung. Kimi K3 erreichte 1.679 Punkte im Frontend Code Arena — das erste Open-Weight-Modell, das alle Closed-Source-Modelle auf dieser Tabelle schlägt — und Rang 3 im Artificial-Analysis-Intelligence-Index. Musk nannte K3 in Benchmark-Kommentaren „beeindruckend". Die wahrscheinlichste Erklärung: xAI komprimiert sein Release-Tempo auf drei Frontier-Modelle in etwa zwei Monaten, weil der Wettbewerb mit OpenAI, Anthropic und chinesischen Anbietern im Juli stark zunahm.
Informationsquellen festlegen: xAI-Blog (x.ai/news) und @xai verfolgen — keine Beschaffung allein auf Basis von Medienberichten
Baseline dokumentieren: Grok-4.5-Token-Verbrauch und Erfolgsquoten auf echten Team-Tasks für A/B-Vergleich nach 4.6-Release erfassen
Budgetpuffer einplanen: Obergrenze mit 4.5s 2 USD/6 USD schätzen, Fallback-Routen zu Kimi K3 oder GPT-5.6 Sol vorbereiten
4.6 vs. 4.7 trennen: Latenzsensitive Workloads bevorzugen ggf. 4.6; Teams mit Peak-Anforderungen und tolerierbarer Inferenzlatenz sollten 4.7 beobachten
Anbieter- und DSGVO-Risiko prüfen: xAIs CSAM-Klage, Common-Sense-Media-Bewertung und DSGVO-konforme Verarbeitung personenbezogener Prompt-Daten in die Unternehmensrichtlinie einbeziehen
Zugangswege vorbereiten: Basierend auf Grok 4.5 Grok Build, xAI-API und Cursor auf Day-One-Integrationen prüfen
Branchenkontext: Während einige Labs für langsameres Tempo plädieren, komprimiert xAI seinen Release-Zyklus auf drei Frontier-Modelle in etwa zwei Monaten. Für Teams sind Token-Effizienz und realer Task-Kosten — nicht Parameterzahl oder Leaderboard-Rang — die stabileren Entscheidungskriterien.
Hält Musks Zeitplan, landen Grok 4.6 und Grok 4.7 im selben Monat wie das gemunkelte Claude Fable 5.1 (laut 36kr- und WinCentral-Leaks, zeitlich vor OpenAIs erwartetem GPT-6) und nur Wochen nach Kimi K3s Open-Weight-Schock. Auswahlfenster schrumpfen auf Wochen — das Flaggschiff vom Vormonat trifft möglicherweise schon auf die nächste Generation, bevor die Evaluation abgeschlossen ist.
Wer Grok 4.6 in Cursor-ähnliche Langsession-Coding-Agenten oder iOS-CI-Pipelines einbinden will, stößt auf Laptop oder instabilem Linux-VPS oft auf Speichermangel, abgebrochene Sessions und fehlende Xcode/Metal-Toolchain. Für Produktionsumgebungen mit stabilen SSH-Sessions, DerivedData-Cache und iOS-CI/CD-Automatisierung ist NodeMinis Mac-Mini-Cloud-Miete in der Regel die bessere Wahl — dedizierte Knoten, Bereitstellung in Sekunden, Agenten und Builds auf derselben echten Mac-Hardware. Details unter Mac-Mini-Mietpreise.
Stand 30. Juli 2026. Quellen: xAI Grok-4.5-Ankündigung und Model Card, Musks X-Post vom 28. Juli 2026, Moonshot Kimi K3 offizielles Release, 36kr/WinCentral zu Claude Fable 5.1, The Verge/TechTimes zu „Pacing the Frontier", Ars Technica/TechCrunch zu xAI-Sicherheitskontroversen.
Musk nannte „ca. 7. August 2026" in einem X-Post, xAI hat das Datum jedoch nicht offiziell bestätigt. Behandeln Sie es als Zieltermin, der sich verschieben kann. Für stabiles Agent-Hosting siehe Mac-Mini-Mietpreise.
Grok 4.6 ist ein 1,5-Billionen-Parameter-Modell mit Fokus auf SFT/RL-Nachtraining. Grok 4.7, einige Wochen später erwartet, hat 2,1 Billionen Parameter und soll laut Musk in fast allen Bereichen besser sein als 4.6, bei etwas langsamerer Inferenz aber höherer Token-Effizienz.
Zu früh für eine Aussage. Grok 4.6 hat noch keine veröffentlichten Benchmarks, Kimi K3 verfügt über verifizierte Drittanbieter-Ergebnisse (einschließlich Spitzenplatz im Frontend Code Arena), und Claude Fable 5.1 ist von Anthropic noch nicht offiziell bestätigt.
Unbekannt. Grok 4.5 startete bei 2 USD pro Million Eingabe-Tokens und 6 USD pro Million Ausgabe-Tokens — ein sinnvoller Referenzwert, aber xAI hat keine Grok-4.6-Preise genannt. Am Release-Tag unbedingt bestätigen.
Basierend auf dem Grok-4.5-Rollout dürften Grok Build, die xAI-API und die xAI-Konsole zuerst Zugang erhalten, gefolgt von Drittanbieter-Integrationen wie Grok 4.5s Day-One-Verfügbarkeit in Cursor. Setup-Fragen beantwortet das Hilfezentrum.