Startseite / Blog / Grok 4.6
ENGINEERING_BLOG · 2026.07.30

Grok 4.6 Release:
Ist der 7.-August-Termin realistisch?

Elon Musk kündigte am 28. Juli 2026 auf X an, dass Grok 4.6 etwa am 7. August erscheinen soll — gefolgt von einem größeren Grok 4.7 wenige Wochen später. Die Antwort richtete sich an Vercel-CEO Guillermo Rauch; weder SpaceXAI-Blog noch Modellkarte bestätigen Datum oder Specs. Dieser Leitfaden richtet sich an Entwickler und technische Leads, die Frontier-Releases, Agent-Routing und Token-Ökonomie verfolgen: Zeitplan, Parameter, Wettbewerbskontext und offene Punkte — mit DSGVO-relevanten Hinweisen für Unternehmensteams.

SECTION 01 Drei typische Fehlinterpretationen vor dem Grok-4.6-Launch

  • Post als offiziellen Launch werten: Die einzige dokumentierte Quelle ist Musks X-Antwort vom 28. Juli. SpaceXAI-Blog und Produktseiten haben Datum und Specs nicht bestätigt;
  • Parameterzahl mit Leistung gleichsetzen: Musk betonte SFT- und RL-Nachbearbeitung, nicht bloße Skalierung — konsistent mit Grok 4.5s Coding-First-Positionierung;
  • „Musk Time“ ignorieren: Termine von xAI, Tesla und SpaceX verschieben sich historisch um Tage bis Wochen. „Etwa 7. August“ ist ein Ziel, keine Garantie;
  • Gerüchte mit gelieferten Modellen vermischen: Claude Fable 5.1 ist von Anthropic nicht offiziell bestätigt. Vergleiche mit gelieferten Produkten wie Kimi K3 und Grok 4.5 — mit klarer Quellenkennzeichnung;
  • Vendor-Risiko ausblenden: Im Juli 2026 verklagte SpaceXAI einen Nutzer wegen mutmaßlicher CSAM-Generierung via Grok. Das sagt nichts über Grok-4.6-Benchmarks aus, gehört aber in die Enterprise-Bewertung — einschließlich DSGVO-konformer Lieferantenprüfung und Dokumentation im Verarbeitungsverzeichnis.

Kurz: Die Grok-4.6/4.7-Roadmap ist plausibel, aber von Dritten unverifiziert. Der August 2026 könnte der dichteste Release-Monat werden — Modellwahl nach Token-Effizienz und realer Aufgabenkosten, nicht nach Parameter-Schlagzeilen.

SECTION 02 Zeitplan und Specs: Grok 4.5 bis 4.7

Schlüsselereignisse Juli bis September 2026
Datum Ereignis
8. Juli 2026 SpaceXAI liefert Grok 4.5 für Coding und agentische Arbeit, Co-Training mit Cursor auf echten Entwicklersessions. 500K-Token-Kontext, $2/$6 pro Million Input/Output-Tokens, Modellkarte mit 15 Benchmark-Scores
16.–26. Juli 2026 Moonshot AIs Kimi K3 wechselt von gehosteter Preview zu vollständigem Open-Weight-Release (2,8T Parameter, 1M-Token-Kontext)
28. Juli 2026 Musk postet Grok-4.6/4.7-Roadmap als Antwort an Rauch. Am selben Tag veröffentlichen 1.200+ Mitarbeiter von OpenAI, Anthropic, Google DeepMind und Meta den Brief „Pacing the Frontier“
~7. August 2026 Grok-4.6-Ziel: 1,5T Parameter, SFT/RL-Upgrade (via Tweet angekündigt, noch nicht geliefert)
Ende Aug.–Anfang Sep. 2026 Grok-4.7-Ziel: 2,1T Parameter. Musk: übertrifft 4.6 in allen Bereichen außer Serving-Geschwindigkeit, bessere Token-Effizienz
Grok 4.3–4.7 im Überblick
Modell Datum Parameter Fokus Status
Grok 4.3 Beta 17. Apr. 2026 Nicht veröffentlicht Vorgänger-Baseline Geliefert
Grok 4.5 8. Juli 2026 Nicht veröffentlicht (Single SKU, kein MoE) Coding/agentisch, Cursor-Co-Training Geliefert, benchmarked
Grok 4.6 ~7. Aug. 2026 1,5T SFT/RL-Upgrade Via Tweet angekündigt, ungeliefert
Grok 4.7 ~Ende Aug.–Anfang Sep. 2026 2,1T Breites Upgrade über 4.6, bessere Token-Effizienz Via Tweet angekündigt, ungeliefert

Alle Grok-4.6/4.7-Angaben stammen aus einem einzigen Social-Media-Post — als Richtwerte behandeln, nicht als bestätigte Specs.

SECTION 03 Warum SpaceXAI Nachbearbeitung statt bloßer Skalierung betont

Supervised Fine-Tuning (SFT) trainiert ein Modell auf kuratierten Beispielausgaben, um Verhalten zu formen. Reinforcement Learning (RL) nutzt Belohnungssignale, um wirksame Aktionssequenzen zu lehren — entscheidend für mehrstufige agentische Tasks. Musks Formulierung „signifikant verbessertes SFT & RL“ signalisiert, dass SpaceXAI die Strategie verdoppelt, die Grok 4.5 auf agentischen Benchmarks wettbewerbsfähig machte: rund 15.954 Output-Tokens pro SWE-Bench-Pro-Task gegenüber 67.020 bei Opus 4.8 — eine 4,2×-Effizienzlücke durch Nachbearbeitung auf echten Cursor-Entwicklersessions.

Der Sprung von Grok 4.6 auf 1,5T Parameter ist eine echte Skalierung, aber Musks Grok-4.7-Framing — größer mit 2,1T, „in jeder Hinsicht besser, nur etwas langsamer zu bedienen“ — deutet auf zwei SKUs mit unterschiedlichen Trade-offs statt eines Allzweckmodells hin.

Das Grok-4.6-Zieldatum liegt fast exakt zehn Tage nach Kimi K3s vollständigem Open-Weight-Release, das die Branche aufwühlte. Kimi K3 führte die Frontend Code Arena mit 1.679 Punkten an — erstes Open-Weight-Modell, das alle Closed Models auf dieser Tafel schlägt — und landete auf Platz drei im Artificial-Analysis-Intelligence-Index. Musk kommentierte Benchmark-Posts zu Kimi K3 mit „impressive“. Dieser Wettbewerbsdruck erklärt am plausibelsten, warum SpaceXAI drei Frontier-Modelle in rund zwei Monaten anstrebt.

Grok im Feldvergleich
Modell Anbieter Parameter Kontext Preis (Input/Output pro 1M Tokens)
Grok 4.5 SpaceXAI Nicht veröffentlicht 500K $2 / $6
Grok 4.6 (angekündigt) SpaceXAI 1,5T Nicht veröffentlicht Nicht veröffentlicht
Kimi K3 Moonshot AI 2,8T (MoE, ~16/896 Experten aktiv) 1M $0,30 (Cache-Treffer) / $3 (Cache-Miss) Input, $15 Output
Claude Fable 5.1 (Gerücht) Anthropic Nicht veröffentlicht Nicht veröffentlicht Gerücht: unverändert zu Fable 5 ($10 in / $50 out)
GPT-5.6 Sol OpenAI Nicht veröffentlicht Nicht veröffentlicht Nicht veröffentlicht

Grok 4.6 und Claude Fable 5.1 sind Pre-Release-Angaben, keine verifizierten Benchmarks — nützlich für Timing und Positionierung, nicht für Head-to-Head-Leistungsvergleiche.

SECTION 04 Was Sie vor Vertrauen in diesen Zeitplan prüfen sollten

  • Einzige Quelle ist ein Tweet. Kein SpaceXAI-Blogpost, keine Modellkarte, keine Produktseite bestätigt Grok-4.6-Specs oder -Datum;
  • Benchmarks und Preise fehlen. Im Gegensatz zu Grok 4.5s detailliertem Launch-Material gibt es für Grok 4.6 keine unabhängige Evaluation und keine offizielle Modellkarte;
  • SpaceXAI kämpft parallel mit Sicherheitskontroversen. Im Juli 2026 verklagte SpaceXAI einen Nutzer wegen mutmaßlicher CSAM-Generierung via Grok — erste Klage dieser Art. Ein Common-Sense-Media-Bericht von Januar 2026 stufte Grok unter die schlechtesten KI-Chatbots für Kindersicherheit ein;
  • Timing kollidiert mit Branchen-Spaltung beim AI-Tempo. Am selben Tag wie Musks Grok-4.6/4.7-Ankündigung veröffentlichten über 1.200 Mitarbeiter „Pacing the Frontier“ und baten die US-Regierung, automatisierte KI-Entwicklung zu bremsen. OpenAI und Anthropic unterstützten als Unternehmen. SpaceXAI fehlt auf der Liste;
  • DSGVO für EU-Enterprise: Prompts und Code-Snippets an US-Endpunkte (us-east-1, us-west-2) können Drittlandübermittlungen nach Art. 44 ff. DSGVO auslösen. Vor Produktions-Routing auf Grok 4.6 AVV, SCCs und technische Maßnahmen nach Art. 32 dokumentieren.

Hält Musks Zeitplan, landen Grok 4.6 und Grok 4.7 im selben Monat wie ein gemunkeltes Claude Fable 5.1 (Leaks von 36kr und WinCentral) und wenige Wochen nach Kimi K3s Open-Weight-Schock. Für Modellbewerter verkürzt das die Nutzungsdauer jedes Flaggschiffs auf Wochen — Token-Effizienz und reale Aufgabenkosten werden zur dauerhafteren Entscheidungsgrundlage.

SECTION 05 Zitierfähige Specs und 6-Schritte-Checkliste vor dem Launch

  • Grok-4.5-Benchmarks (geliefert): Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 % (offizielle SpaceXAI-Modellkarte);
  • Grok-4.5-Token-Effizienz: ~15.954 Output-Tokens pro SWE-Bench-Pro-Task vs. ~67.020 bei Opus 4.8 (Drittquellen);
  • Grok 4.6 angekündigt: 1,5T Parameter, SFT/RL-Fokus (Musk-X-Post, unverifiziert);
  • Grok 4.7 angekündigt: 2,1T Parameter, breit besser als 4.6, langsamer zu bedienen (Musk-X-Post);
  • Kimi-K3-Referenz: Frontend Code Arena 1.679 Punkte, 2,8T MoE, 1M-Token-Kontext (Moonshot offiziell);
  • Grok-4.5-Preisreferenz: $2 Input / $6 Output pro Million Tokens (SpaceXAI offiziell).
  1. Source of Truth festlegen: SpaceXAI-Blog und @xai auf X verfolgen. Produktion nicht allein auf Zweitberichte umstellen;
  2. Baseline-Matrix aufbauen: Vor Grok-4.6-Modellkarte Grok 4.5 und Kimi K3 auf eigenen Repos benchmarken. Token-Ausgaben und Pass-Raten protokollieren;
  3. A/B-Fenster reservieren: Keine Jahres-API-Verträge in der ersten Augustwoche abschließen. Budget für Grok 4.6 und gemunkeltes Fable 5.1 einplanen;
  4. „Stärker“ vs. „Schneller“ trennen: Laut Musk ist 4.6 ausgewogen, 4.7 qualitätslastig. Separate Routen für latenz- und qualitätssensitive Workloads;
  5. Sicherheit und Compliance prüfen: CSAM-Klage und Kindersicherheits-Ratings in Vendor-Policy und DSGVO-Lieferantenbewertung einbeziehen;
  6. Preise am Launch-Tag abgleichen: SpaceXAI-Konsole und API-Docs als Ground Truth. Grok-4.5-Preise nicht für Finanzmodelle annehmen.

Offizielle und Drittquellen — vor Verlassen auf Datum, Spec oder Preis live prüfen:

SpaceXAI: Introducing Grok 4.5

Elon Musk auf X (28. Juli 2026, Antwort an @rauchg)

Moonshot AI: Kimi K3 auf GitHub

Baut Ihr Team Agents und iOS/macOS-CI-Pipelines auf Grok, Kimi oder anderen Frontier-Modellen, addieren virtualisierte Mac-Umgebungen Overhead bei Xcode-Builds und Metal-Workloads. Für Produktionssetups mit verlustfreier nativer Rechenleistung, stabiler iOS-CI/CD und 7×24-Agent-Automatisierung sind MACNOX dedizierte Cloud-Mac-Physikknoten meist die bessere Wahl: echte Apple-Hardware, voller Root, kein Hypervisor-Steuer, flexible Tages-/Wochen-/Monatsmiete. Siehe auch unseren Grok-4.5-Test und Kimi-K3-Open-Weight-Bericht.

SECTION 06 FAQ

Wann genau erscheint Grok 4.6?

Musk nannte „etwa 7. August 2026“ in einem X-Post; SpaceXAI hat kein offizielles Datum bestätigt. Als verschiebbares Ziel behandeln.

Was unterscheidet Grok 4.6 von Grok 4.7?

Grok 4.6 ist ein 1,5T-Parameter-Modell mit Fokus auf SFT/RL-Nachbearbeitung. Grok 4.7, wenige Wochen später erwartet, hat 2,1T Parameter; Musk sagt, es übertrifft 4.6 in allen Bereichen außer Serving-Geschwindigkeit und bietet bessere Token-Effizienz.

Schlägt Grok 4.6 Kimi K3 oder Claude Fable 5.1?

Zu früh. Grok 4.6 hat noch keine veröffentlichten Benchmarks, Kimi K3 hat verifizierte Drittscores, Claude Fable 5.1 ist von Anthropic nicht offiziell bestätigt. Ein echter Vergleich erst möglich, wenn Grok 4.6 mit Modellkarte liefert.

Was kostet Grok 4.6?

Unbekannt. Grok 4.5 startete bei $2 pro Million Input-Tokens und $6 pro Million Output-Tokens — ein sinnvoller Referenzpunkt, aber SpaceXAI hat Grok-4.6-Preise nicht genannt.

Wo kann ich Grok 4.6 nutzen?

Nach Grok-4.5-Rollout wahrscheinlich zuerst Grok Build, SpaceXAI-API und Konsole, danach Drittplattform-Integrationen — für 4.6 noch nicht bestätigt.