Grok 4.6 startet zu $2/$6 — 61 Punkte im AA-Index, gleichauf mit GPT-5.6 Sol

SpaceXAI logoSpaceXAIUrteil geändert13. August 2026Modelle
Was ist passiert
SpaceXAI launched Grok 4.6 on Aug 12 at $2/$6, scoring 61 on the AA Intelligence Index — tying GPT-5.6 Sol for third, behind Claude Opus 5 and Claude Fable 5.
Warum es wichtig ist
It's frontier-competitive and the cheapest in its class — the model to watch for long-running agents and visual/interactive work.
Was zu tun ist
Cursor and Grok Build users should try it now (2x included usage this week); everyone else, hold for broader benchmarks before betting production on it.

Grok 4.6 ist am 12. August zu denselben $2 / $6 pro 1M Token erschienen wie Grok 4.5 — und der erste unabhängige Eindruck fällt stark aus: 61 Punkte im Artificial Analysis Intelligence Index, einem aus neun Benchmarks zusammengesetzten Index, der gleichauf mit GPT-5.6 Sol liegt und hinter Claude Opus 5 (63) und Claude Fable 5 (62) zurückbleibt. Wir verschieben das Verzeichnis-Urteil von ausstehend → eingeschränkt — nicht weil die Benchmarks schwach wären, sondern weil ein Modell, das gestern erschienen ist, sich empfohlen noch nicht verdient hat.

Was passiert ist

SpaceXAI hat Grok 4.6 mit gegenüber Grok 4.5 unveränderten Preisen gestartet, dazu eine Fast-Variante zum doppelten Preis für höheren Durchsatz. Die wichtigsten Zahlen (Artificial Analysis, 2026):

MetrikGrok 4.6GPT-5.6 SolFable 5 MaxGrok 4.5
AA Intelligence Index61616256
GDPVal-AA v21.7531.7281.7411.526
CursorBench v3.269,9 %67,2 %70,5 %66,7 %

Die Tabelle oben vergleicht eine Teilmenge von vier Modellen — Claude Opus 5 (63) liegt im AA Intelligence Index über Grok 4.6.

Drei Dinge stechen hervor:

  • GDPVal-AA 1.753 — nur hinter Claude Opus 5, vor Fable 5 Max und GPT-5.6 Sol.
  • Ein Sprung um 5 Punkte im Gesamtindex gegenüber Grok 4.5 (56 → 61) zum gleichen Preis.
  • Das doppelte Inklusiv-Kontingent in Grok Build und Cursor in der ersten Woche — SpaceXAI übernimmt die Kosten des Evaluierungszeitraums.

Es erscheint heute in Cursor, Grok Build, der API, OpenRouter, Vercel und Cloudflare. Der Launch-Post rahmt es für langlaufende Agenten und ambitioniertere interaktive/visuelle Arbeit ein: das Durchhalten über viele Schritte hinweg sowie eine stärkere App-Struktur und visuelle Sprache bereits im ersten Anlauf (xAI, 2026).

Warum es wichtig ist

Grok 4.6 ist an der Frontier wettbewerbsfähig zum günstigsten Preis seiner Klasse. Gleichauf mit GPT-5.6 Sol im Gesamtindex — zu $2/$6, unverändert gegenüber Grok 4.5 — setzt es die Kosten-Leistungs-Rechnung für Agenten-Workloads neu auf. Hält der GDPVal-AA-Vorsprung, wird es zur Standardwahl für Teams, die Token für Coding-Agenten verbrennen.

Doch die unabhängige Verifikation stützt sich bislang auf genau einen Evaluator. Artificial Analysis ist bisher die einzige Drittanbieter-Einschätzung. Ein Modell, das gestern erschienen ist, hat keine Langzeit-Zuverlässigkeitsbilanz — keine mehrstufigen Agenten-Stresstests, keine mehrtägigen Daten zur Aufgabenerledigung. Das ist die Lücke zwischen eingeschränkt und empfohlen, und ein Ein-Tages-Gesamtindex schließt sie nicht.

Die Positionierung ist agent-first. Der Launch führt mit Durchhaltevermögen über viele Schritte sowie Struktur und Visuals im ersten Anlauf, ausgerichtet auf Cursor- und Grok-Build-Nutzer — kein Vorstoß in Richtung Allzweck-Assistent.

Was sich für Sie ändert

Auf Cursor oder Grok Build: probieren Sie es diese Woche aus. Das doppelte Inklusiv-Kontingent macht die Evaluierung nahezu kostenlos, und Grok-4.5-Nutzer erhalten ein spürbares Upgrade zum gleichen Preis.

Produktiveinsatz: zurückhalten. Lassen Sie die breiteren Benchmarks landen, bevor Sie kritische Workloads darauf routen. Ein einzelner Gesamtindex, so stark er auch ist, ist keine Zuverlässigkeitsbilanz.

Durchsatz gefragt: Achten Sie auf die Fast-Variante. Sie läuft zum doppelten Preis; das lohnt sich nur, wenn Ihr Workload latenzgebunden ist, nicht token-gebunden.

FAQ

Was hat sich zwischen Grok 4.6 und Grok 4.5 geändert? Die Preise bleiben bei $2/$6 unverändert, aber Grok 4.6 bringt einen Sprung um 5 Punkte im Gesamtindex (56 → 61), ein GDPVal-AA-Ergebnis, das nur hinter Claude Opus 5 liegt, und — laut Launch-Post — besseres Durchhaltevermögen bei langlaufenden Agenten-Aufgaben sowie eine stärkere App-Struktur und visuelle Sprache im ersten Anlauf (xAI, 2026).

Ist Grok 4.6 besser als GPT-5.6 Sol? Sie liegen im AA Intelligence Index gleichauf bei 61. Grok 4.6 führt bei GDPVal-AA (1.753 vs. 1.728) und CursorBench (69,9 % vs. 67,2 %) vor GPT-5.6 Sol, während Claude Opus 5 (63) und Claude Fable 5 (62) im Gesamtindex weiter vorn liegen. Zu $2/$6 ist Grok 4.6 der günstigere Weg in diese Leistungsklasse — mit deutlich weniger nachweisbarer Bilanz.

Sollte ich Produktions-Workloads jetzt auf Grok 4.6 verlagern? Noch nicht. Es stützt sich erst auf einen einzigen Evaluator und ist einen Tag alt. Evaluieren Sie diese Woche — insbesondere auf Cursor und Grok Build mit dem doppelten Inklusiv-Kontingent — und lassen Sie unabhängige agentische und langfristige Benchmarks landen, bevor es in Produktion geht.

pendingvorherige Wahl
conditionalneue Wahl

Launch completes the pending entity: 61 AA Intelligence Index (ties GPT-5.6 Sol, behind Claude Opus 5 and Claude Fable 5) at $2/$6, with GDPVal-AA behind only Claude Opus 5.

Was zu tun ist

  1. 1 If you're on Cursor or Grok Build, try Grok 4.6 this week — the 2x included usage makes it a low-cost evaluation.
  2. 2 Hold production bets until the broader benchmark set lands; one evaluator (Artificial Analysis) is the only independent read so far.
  3. 3 Watch the 'Fast variant' at 2x price only if your workload is latency-bound, not token-bound.

Betroffene Tools & Modelle

Nie wieder etwas verpassen

Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.

Mit dem Abonnieren stimmst du unserer Datenschutzerklärung zu. Jederzeit abbestellbar.