Grok 4.5 startet mit $2/$6 — unterbietet Opus um 60%

SpaceXAI logoSpaceXAIWichtig9. Juli 2026Modelle
Was ist passiert
SpaceXAI released Grok 4.5 on July 8 — its first post-IPO model — at $2/$6 per million tokens and 80 TPS. Trained alongside Cursor IDE data.
Warum es wichtig ist
At $2/$6, Grok 4.5 undercuts Opus 4.8 by 60%+ and GPT-5.6 Sol by 80% — the most aggressive frontier-adjacent pricing from any major lab this year. It resolves SWE Bench Pro with 4.2x fewer output tokens than Opus 4.8.
Was zu tun ist
Cost-sensitive teams running agentic coding loops should evaluate Grok 4.5 now — the pricing is live and the token-efficiency advantage is real. Wait for independent benchmarks before routing mission-critical tasks. EU users: availability expected mid-July.

SpaceXAI hat Grok 4.5 am 8. Juli veröffentlicht — das erste Modell seit dem Börsengang des Unternehmens im letzten Monat — und die Preisgestaltung ist die eigentliche Geschichte. Mit $2 pro Million Eingabe-Tokens und $6 pro Million Ausgabe-Tokens unterbietet Elon Musks Labor jeden frontiernahen Wettbewerber um einen Abstand, der groß genug ist, um die Kostendiskussion für den gesamten Markt neu zu setzen.

Unser Urteil: conditional. Grok 4.5 ist im Verzeichnis, und für den richtigen Käufer — kostensensible Teams, die agentische Coding-Workloads betreiben — ist das Wertversprechen echt. Der Haken: Jeder veröffentlichte Benchmark ist vom Anbieter durchgeführt, und Musks „Opus-Klasse"-Einordnung ist seine eigene. Unabhängige Überprüfung unterscheidet einen Preisschritt von einer Beschaffungsempfehlung.

Grok 4.5: Was SpaceXAI ausgeliefert hat

SpaceXAI veröffentlichte am Mittwoch Benchmarks, die Grok 4.5 als wettbewerbsfähig mit führenden Modellen bei Coding, Reasoning und Allgemeinwissen zeigen — wenn auch knapp unter der Spitzenklasse bei den meisten Metriken (TechCrunch, 2026(wird in einem neuen Tab geöffnet)). Das Unternehmen beansprucht eine „doppelt so hohe Token-Effizienz" wie andere führende Modelle.

Die Preisgestaltung ist die Schlagzeile:

ModellEingabe (pro 1M)Ausgabe (pro 1M)Grok-Ersparnis
Grok 4.5$2$6
Claude Opus 4.7$5$2560% / 76%
GPT-5.6 Sol$5$3060% / 80%
GPT-5.6 Luna$1$6-100% / 0%

Musk charakterisierte Grok 4.5 als „ungefähr vergleichbar mit Opus 4.7, aber deutlich schneller" in einem Folgebeitrag auf X(wird in einem neuen Tab geöffnet). „Die Kombination aus Fähigkeit, höherer Geschwindigkeit und niedrigeren Kosten macht es wettbewerbsfähig."

SpaceXAI gibt an, dass starkes positives Feedback aus dem Beta-Testprogramm zum beschleunigten öffentlichen Launch am 9. Juli führte.

Warum es wichtig ist

Dies ist die aggressivste Preisgestaltung eines großen KI-Labors in diesem Jahr. SpaceXAI (ehemals xAI) ist jetzt ein börsennotiertes Unternehmen mit Zugang zu Kapitalmärkten. Ein glaubwürdiges frontiernahes Modell zu $2/$6 — das das Anthropic-Flaggschiff um 60% und OpenAIs Sol um 80% unterbietet — zwingt jedem Wettbewerber die Preishand.

Die Token-Effizienz-Zahlen sind bemerkenswert: Grok 4.5 löst SWE Bench Pro-Aufgaben mit ~16K Ausgabe-Tokens gegenüber Opus 4.8s 67K — ein 4,2-facher Vorteil. Für Teams, die umfangreiche agentische Coding-Schleifen ausführen, wo Token-Kosten sich summieren, ist dieser Effizienzvorsprung echtes Geld (SpaceXAI, 2026(wird in einem neuen Tab geöffnet)).

Aber die Fähigkeitsgeschichte ist nuanciert. SpaceXAIs eigene veröffentlichte Benchmarks platzieren Grok 4.5 hinter Fable 5 und GPT-5.5 bei den meisten Coding-Bewertungen, obwohl es Opus 4.8 bei DeepSWE 1.0, SWE Marathon und Terminal Bench 2.1 anführt. Trainiert mit Cursor IDE-Interaktionsdaten, ist Grok 4.5 zweckgebaut für langlaufende Tool-Nutzung und mehrschrittiges Engineering — nicht um die absolute Frontier bei reinen Reasoning-Benchmarks zu verschieben.

Die Vorbehalte

Wir haben Grok 4.5 nicht unabhängig getestet. Jeder zitierte Benchmark ist vom Anbieter gemeldet — derselbe Vorbehalt, den wir bei jedem Modell-Launch anwenden. Musks „Opus-Klasse"-Behauptung ist nach seiner eigenen Einschränkung (vergleichbar mit Opus 4.7, nicht dem aktuellen Opus 4.8) richtungsmäßig zutreffend, aber das Modell führt die Frontier bei keiner unabhängig verifizierten Metrik an.

Die Wettbewerbslandschaft ist zudem ein bewegliches Ziel: GPT-5.6 Sol wird voraussichtlich heute (9. Juli) öffentlich starten (TechCrunch, 2026(wird in einem neuen Tab geöffnet)). Grok 4.5 tritt in einen Markt ein, in dem die Frontier in Echtzeit neu definiert wird — und es ist noch nicht in der EU verfügbar (Mitte Juli erwartet).

FAQ

Lohnt es sich, jetzt auf Grok 4.5 zu wechseln?

Für kostensensibles agentisches Coding, ja — $2/$6-Preisgestaltung mit 80 TPS und 4,2-facher Token-Effizienz gegenüber Opus 4.8 ist ein überzeugendes Wertversprechen. Für geschäftskritische Workloads, bei denen eine einzige falsche Antwort teuer ist, warten Sie auf unabhängige Benchmarks.

Wie schneidet Grok 4.5 tatsächlich im Vergleich zu Opus 4.8 ab?

SpaceXAIs vom Anbieter gemeldete Benchmarks zeigen Grok 4.5 hinter Opus 4.8 bei den meisten Standard-Coding-Evaluierungen, aber führend bei DeepSWE 1.0, SWE Marathon und Terminal Bench 2.1. Musk selbst relativierte es als „ungefähr vergleichbar mit Opus 4.7" — nicht dem aktuellen Opus 4.8. Unabhängige Überprüfung steht aus.

Wann kommen unabhängige Benchmarks?

Kein Zeitplan bestätigt. Artificial Analysis und andere unabhängige Evaluatoren veröffentlichen typischerweise innerhalb von Tagen nach einem öffentlichen API-Launch. Wir aktualisieren das Verzeichnis-Urteil, sobald sie vorliegen.

Was sich für Sie ändert

Wenn Sie kostensensibles agentisches Coding betreiben: Grok 4.5s $2/$6-Preisgestaltung — gepaart mit 80 TPS Geschwindigkeit — macht es zum günstigsten Modell in der frontiernahen Diskussion. Für Teams, die bereits hochvolumige Aufgaben an Budget-Stufen routen, bietet Grok 4.5 nahezu Opus-Leistung bei Coding-Benchmarks zu einem Bruchteil der Token-Kosten.

Wenn Sie die absolut beste Fähigkeit benötigen: Dies ist nicht Ihr Modell. Fable 5 und Opus 4.8 führen dort, wo reines Reasoning und frontier Coding-Tiefe zählen. Nutzen Sie Grok 4.5 dort, wo Token-Effizienz sich über lange Agentenschleifen summiert — nicht dort, wo eine einzige falsche Antwort teuer ist.

Wenn Sie in der EU sind: Warten Sie. Die Verfügbarkeit wird für Mitte Juli erwartet, ist aber nicht bestätigt.

Unser Standpunkt ist klar: Die Preisgestaltung ist real, der Launch ist real, und die Token-Effizienz-Zahlen — sofern sie unabhängiger Prüfung standhalten — sind das stärkste Argument für Grok 4.5 gegenüber jeder Anthropic- und OpenAI-Alternative. Was fehlt, ist unabhängige Verifizierung. Wir aktualisieren das Urteil, wenn unabhängige Benchmarks vorliegen.

Betroffene Tools & Modelle

Nie wieder etwas verpassen

Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.

Mit dem Abonnieren stimmst du unserer Datenschutzerklärung zu. Jederzeit abbestellbar.