Wer Ende Sommer 2026 Frontier-Modelle per API evaluiert, sollte Grok 4.6 separat auf der Watchlist führen: Am 28. Juli antwortete Elon Musk auf X dem Vercel-CEO Guillermo Rauch und nannte den 7. August als Zieltermin für Grok 4.6 mit 1,5 Billionen Parametern, gefolgt innerhalb weniger Wochen von Grok 4.7 mit 2,1 Billionen — xAI hat jedoch weder Benchmarks noch Preise offiziell veröffentlicht. Dieser Artikel strukturiert Zeitachse, Kerndaten, SFT/RL-Upgrade-Logik, Wettbewerbsvergleich und Kontroversen entlang fünf Achsen und markiert klar, was noch auf einer einzelnen Social-Media-Quelle beruht.
Warum Entwickler den Grok-4.6-Zeitplan jetzt verfolgen sollten
Die Ankündigung wirkt wie Executive PR, hat aber drei unmittelbare Auswirkungen auf Engineering-Teams:
- Auswahlfenster schrumpfen: Grok 4.5 erschien am 8. Juli; landet 4.6 am 7. August, beträgt die effektive Nutzungsdauer eines Flaggschiffs möglicherweise nur einen Monat — zusammen mit dem Hugging-Face-Vorfall im Juli und dem GPT-6-Regulierungsrennen müssen Multi-Modell-Orchestrierungskosten monatlich neu kalkuliert werden.
- Informationsquelle extrem schmal: Parameterzahlen und SFT/RL-Behauptungen zu Grok 4.6/4.7 stammen aus einer einzigen Musk-Antwort — ohne begleitende Model Card, im Gegensatz zu Grok 4.5 mit 15 veröffentlichten Benchmarks. Integrationen brauchen Puffer für Terminverschiebungen und Spezifikationsänderungen.
- Open-Weight-Schock ist Realität: Kimi K3 veröffentlichte am 26. Juli vollständige Open-Weight-Gewichte mit 2,8 Billionen Parametern und erreichte 1.679 Punkte im Frontend Code Arena. Wenn xAI innerhalb von zwei Monaten drei Frontier-Modelle lanciert, verschiebt sich der Wettbewerb von reiner Skalierung zu Token-Effizienz und Agent-Post-Training-Qualität.
Grenze zuerst: Termine und Parameter von Grok 4.6/4.7 stammen aus Musks X-Post vom 28. Juli. xAI-Blog und Produktseiten haben sie nicht bestätigt. Historisch verschiebt sich „Musk time" um Tage bis Wochen — vor produktiven Abhängigkeiten offizielle xAI-Kanäle prüfen.
Zeitachse: Von Grok 4.5 über 4.6 bis 4.7
| Datum | Ereignis |
|---|---|
| 8. Juli 2026 | xAI veröffentlicht Grok 4.5 als Flaggschiff für Coding und Agenten-Aufgaben, Co-Training mit Cursor auf echten Entwicklersitzungen; 500.000-Token-Kontext; Preis $2/$6 pro Million Input/Output-Tokens |
| 16. Juli 2026 | Moonshot AIs Kimi K3 geht als gehosteter Dienst live |
| 26. Juli 2026 | Kimi K3 veröffentlicht vollständige Open-Weight-Gewichte — 2,8 Billionen Parameter, 1-Million-Token-Kontext |
| 28. Juli 2026 | Musk postet Grok-4.6/4.7-Roadmap als Antwort an Rauch; am selben Tag veröffentlichen über 1.200 Mitarbeitende von OpenAI, Anthropic und weiteren Laboren den offenen Brief „Pacing the Frontier" |
| ~7. August 2026 (Ziel) | Grok 4.6 geplant — 1,5 Billionen Parameter, Fokus auf SFT- und RL-Upgrade |
| ~Ende Aug.–Anfang Sep. 2026 (geschätzt) | Grok 4.7 geplant — 2,1 Billionen Parameter; Musk: in jeder Hinsicht besser als 4.6, außer etwas langsamer beim Serving, mit höherer Token-Effizienz |
Kerndaten und Wettbewerbsvergleich
Die Tabelle fasst bekannte Spezifikationen zusammen. Zeilen zu Grok 4.6 und Claude Fable 5.1 sind Vorabankündigungen oder Gerüchte — keine Head-to-Head-Benchmarks.
| Modell | Datum | Parameter | Kontext | Preis (In/Out pro 1M Tokens) | Status |
|---|---|---|---|---|---|
| Grok 4.5 | 8. Juli 2026 | Nicht offengelegt | 500K | $2 / $6 | Veröffentlicht |
| Grok 4.6 (angekündigt) | ~7. Aug. | 1,5 Billionen | Nicht offengelegt | Nicht offengelegt | Nur Tweet, unveröffentlicht |
| Grok 4.7 (angekündigt) | ~Ende Aug.–Anfang Sep. | 2,1 Billionen | Nicht offengelegt | Nicht offengelegt | Nur Tweet, unveröffentlicht |
| Kimi K3 | 26. Juli Open-Weight | 2,8 Billionen (MoE) | 1M | $0,30 (Cache-Hit) / $3 (Miss) In, $15 Out | Veröffentlicht |
| Claude Fable 5.1 (Gerücht) | Gerücht: August | Nicht offengelegt | Nicht offengelegt | Gerücht: Fable-5-Niveau ($10/$50) | Von Anthropic nicht bestätigt |
| GPT-5.6 Sol | Veröffentlicht | Nicht offengelegt | Nicht offengelegt | Nicht offengelegt | Veröffentlicht |
Upgrade-Fokus: Post-Training statt reiner Skalierung
Supervised Fine-Tuning (SFT) korrigiert Ausgabeverhalten anhand kuratierter Beispiele; Reinforcement Learning (RL) trainiert korrekte Aktionssequenzen in mehrstufigen Agenten-Aufgaben. Musks Betonung von „signifikant verbessertem SFT & RL" setzt Grok 4.5 fort: Co-Training auf echten Cursor-Entwicklersitzungen ergab Terminal-Bench 2.1 mit 83,3 % und SWE-Bench Pro mit 64,7 % — etwa 15.954 Output-Tokens pro SWE-Bench-Pro-Aufgabe gegenüber 67.020 bei Opus 4.8, ein 4,2-facher Effizienzvorsprung.
Die 1,5-Billionen-Sprung bei Grok 4.6 ist ein echtes Scale-up, doch Musks Grok-4.7-Framing — größer mit 2,1 Billionen, „besser in jeder Hinsicht außer etwas langsamer beim Serving" — deutet auf zwei SKUs mit unterschiedlichen Latenz/Qualitäts-Trade-offs hin. Das ~7.-August-Ziel liegt knapp 10 Tage nach Kimi K3s Open-Weight-Schock; Musk kommentierte Kimi-K3-Benchmark-Posts mit „impressive", und Analysten lesen die komprimierte xAI-Kadenz als direkte Antwort auf OpenAI, Anthropic und chinesische Labore.
Fünf-Schritte-Checkliste vor dem Release
Bevor Grok 4.6 mit offizieller Model Card erscheint, Integrationsrisiken so steuern, dass Vorschau-Specs keine Produktionsabhängigkeiten werden:
- Quellenebenen taggen: Musks X-Post als „direktional" markieren; Grok-4.5-Model-Card als verifizierte Baseline — nie in SLA- oder Kostenmodellen mischen.
- Terminpuffer einplanen: 7–14 Tage über den 7. August hinaus für „Musk time"; Grok 4.5 oder Kimi K3 als Fallback auf kritischen Release-Pfaden bereithalten.
- Token-Effizienz neu rechnen, nicht nur Leaderboard-Rang: Grok 4.5 gewinnt durch weniger Output-Tokens pro Agenten-Aufgabe; wenn 4.6 diesen Pfad fortsetzt, können Rechnungen niedriger ausfallen als bei „intelligenteren, aber längeren" Modellen — auf per-Task-Token-Angaben warten.
- Eval-Umgebungen isolieren: Vorschau-Phasen bedeuten oft geteilte Sandboxes oder lokale Benchmarks — Zustandsverschmutzung und Credential-Rückstände steigen. Sensible Agenten-Ketten mit personenbezogenen Testdaten gehören auf zurücksetzbare, dedizierte Hardware; unter der DSGVO müssen Verarbeitungsorte dokumentiert und Drittlandübermittlungen über API-Evals vertraglich abgesichert sein.
- August-Release-Cluster verfolgen: Gerüchte zu Claude Fable 5.1 zielen ebenfalls auf August; wenn Grok 4.6/4.7 im selben Monat landen, einen festen Prompt-Satz und eine Hardware-Umgebung fixieren, damit wochenübergreifende Vergleiche valide bleiben.
Kontroversen und Risikohinweise
- Zeitplan ohne Drittbestätigung: Einzige Quelle ist Musks X-Antwort — kein xAI-Blogpost, keine Model Card, keine Produktseite.
- Benchmarks und Preise leer: Im Gegensatz zu Grok 4.5s detaillierter Launch-Card gibt es für Grok 4.6 keine unabhängigen Evals oder offizielle Dokumentation.
- xAI-Sicherheitskontroversen: Im Juli 2026 verklagte xAI einen Nutzer wegen mutmaßlicher Nutzung von Grok zur Erzeugung von CSAM — die erste Klage dieser Art, die implizit zugibt, dass Schutzmechanismen umgangen werden können. Ein Common-Sense-Media-Bericht vom Januar 2026 stufte Grok unter den schlechtesten Chatbots für Kindersicherheit ein — relevant für Enterprise-Vendor-Due-Diligence und DSGVO-konforme Auftragsverarbeitungsverträge, nicht für reine Capability-Scores.
- Kollision mit Branchen-„Verlangsamung": Am 28. Juli — dem Tag von Musks Roadmap — unterstützten OpenAI und Anthropic auf Unternehmensebene „Pacing the Frontier"; xAI fehlt auf der Unterzeichnerliste — divergierende Release-Strategien bleiben zu beobachten.
Zitierbare Fakten und Quellen
- Grok-4.6-Zieltermin: ~7. August 2026 — Musks Antwort an @rauchg vom 28. Juli, keine offizielle xAI-Ankündigung.
- Grok-4.6-Parameter: 1,5 Billionen — dieselbe einzelne Social-Media-Quelle, von Dritten nicht verifiziert.
- Grok-4.5-Preise: $2/$6 pro Million Input/Output-Tokens; 500K-Kontext — xAI „Introducing Grok 4.5" und offizielle Model Card.
- Grok-4.5-Agent-Benchmarks: Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 %; Output-Token-Effizienz vs. Opus 4.8 — xAI Model Card und Drittquellen (eesel.ai, felloai.com).
Parameter, Preise und Scores können beim Launch angepasst werden. Offizielle Seiten prüfen. Quellen:
xAI offizieller Blog — Introducing Grok 4.5
xAI Grok 4.5 offizielle Model Card (media.x.ai)
Moonshot AI Kimi K3 Open-Weight-Repository (GitHub)
The Verge — Berichterstattung zum Brief „Pacing the Frontier"
Häufig gestellte Fragen
Wann genau erscheint Grok 4.6?
Musk nannte „ungefähr den 7. August 2026" in einem X-Post, xAI hat kein offizielles Datum bestätigt. Als Zieltermin behandeln, der sich verschieben kann.
Was ist der Unterschied zwischen Grok 4.6 und Grok 4.7?
Grok 4.6 ist ein 1,5-Billionen-Parameter-Modell mit Fokus auf SFT/RL-Post-Training. Grok 4.7, einige Wochen später erwartet, hat 2,1 Billionen Parameter; Musk sagt, es übertrifft 4.6 in jeder Hinsicht außer der Serving-Geschwindigkeit, mit besserer Token-Effizienz.
Schlägt Grok 4.6 Kimi K3 oder Claude Fable 5.1?
Noch nicht beurteilbar. Grok 4.6 hat keine veröffentlichten Benchmarks, Kimi K3 hat verifizierte Drittscores, und Claude Fable 5.1 wurde von Anthropic nicht offiziell bestätigt.
Was kostet Grok 4.6 voraussichtlich?
Unbekannt. Grok 4.5 startete bei $2 pro Million Input-Tokens und $6 pro Million Output-Tokens — ein sinnvoller Referenzwert, aber xAI hat keine Grok-4.6-Preise genannt.
Wo kann ich Grok 4.6 nutzen?
Nach Grok 4.5s Rollout zu erwarten: zuerst Grok Build, xAI-API und xAI-Konsole, danach Drittanbieter-Integrationen — für 4.6 noch nicht bestätigt.
Die Release-Dichte bei Frontier-Modellen steigt, und Multi-Modell-Agenten-Evals auf Laptops oder geteilten VMs bedeuten mehr Zustandsverschmutzung, Credential-Rückstände und versehentliche laterale Bewegung — Neuinstallation pro Modellwechsel ist langsam und schwer reproduzierbar. Wer eine zurücksetzbare, dedizierte Apple-Silicon-Physiknode mit SSH- und VNC-Zugang für isolierte Grok-vs.-Open-Weight-Vergleiche braucht, ist mit VMSPINs Tagesmiete für Cloud-Mac-mini meist auf der sicheren Seite; für längerfristige Kostenrechnung siehe unsere Kauf-vs.-Miete-Break-even-Analyse. Ob Grok 4.6 am 7. August landet, bleibt offen — Ihre Lab-Umgebung muss nicht mitwetten.