Grok 4.5 Livré à $2/$6 — Sous-cote Opus de 60 %

SpaceXAI logoSpaceXAIImportant9 juillet 2026Modèles
Ce qui s’est passé
SpaceXAI released Grok 4.5 on July 8 — its first post-IPO model — at $2/$6 per million tokens and 80 TPS. Trained alongside Cursor IDE data.
Pourquoi c’est important
At $2/$6, Grok 4.5 undercuts Opus 4.8 by 60%+ and GPT-5.6 Sol by 80% — the most aggressive frontier-adjacent pricing from any major lab this year. It resolves SWE Bench Pro with 4.2x fewer output tokens than Opus 4.8.
Que faire
Cost-sensitive teams running agentic coding loops should evaluate Grok 4.5 now — the pricing is live and the token-efficiency advantage is real. Wait for independent benchmarks before routing mission-critical tasks. EU users: availability expected mid-July.

SpaceXAI a lancé Grok 4.5 le 8 juillet — son premier modèle depuis l'introduction en bourse de l'entreprise le mois dernier — et la tarification est la véritable actualité. À $2 par million de tokens d'entrée et $6 par million de tokens de sortie, le laboratoire d'Elon Musk sous-cote chaque concurrent proche de la frontière par une marge suffisamment large pour redéfinir la conversation sur les coûts pour l'ensemble du marché.

Notre verdict : conditional. Grok 4.5 est dans le répertoire, et pour le bon acheteur — les équipes sensibles aux coûts exécutant des charges de codage agentique — la proposition de valeur est réelle. Le bémol : chaque benchmark publié est rapporté par le fournisseur, et le cadrage « classe Opus » de Musk est le sien. La vérification indépendante est ce qui sépare un mouvement tarifaire d'une recommandation d'achat.

Grok 4.5 : ce que SpaceXAI a livré

SpaceXAI a publié mercredi des benchmarks montrant Grok 4.5 compétitif avec les modèles leaders sur les tâches de codage, de raisonnement et de connaissances générales — bien que légèrement en deçà de la meilleure performance sur la plupart des mesures (TechCrunch, 2026(s’ouvre dans un nouvel onglet)). L'entreprise revendique une « efficacité des tokens deux fois supérieure » à celle des autres modèles leaders.

La tarification fait la une :

ModèleEntrée (par 1M)Sortie (par 1M)Économie Grok
Grok 4.5$2$6
Claude Opus 4.7$5$2560 % / 76 %
GPT-5.6 Sol$5$3060 % / 80 %
GPT-5.6 Luna$1$6-100 % / 0 %

Musk a caractérisé Grok 4.5 comme « à peu près comparable à Opus 4.7, mais beaucoup plus rapide » dans un post de suivi sur X(s’ouvre dans un nouvel onglet). « La combinaison de la capacité, de la vitesse supérieure et du coût inférieur est ce qui le rend compétitif. »

SpaceXAI affirme que les retours positifs de son programme de test bêta ont conduit au lancement public accéléré le 9 juillet.

Pourquoi c'est important

C'est la tarification la plus agressive d'un grand laboratoire d'IA cette année. SpaceXAI (anciennement xAI) est désormais une société cotée en bourse avec accès aux marchés de capitaux. Un modèle crédible proche de la frontière à $2/$6 — sous-cotant le flagship d'Anthropic de 60 % et le Sol d'OpenAI de 80 % — force la main tarifaire de chaque concurrent.

Les chiffres d'efficacité des tokens sont frappants : Grok 4.5 résout les tâches SWE Bench Pro avec environ 16K tokens de sortie contre 67K pour Opus 4.8 — un avantage de 4,2x. Pour les équipes exécutant des boucles d'agent de codage extensives où les coûts de tokens s'accumulent, cet écart d'efficacité représente de l'argent réel (SpaceXAI, 2026(s’ouvre dans un nouvel onglet)).

Mais l'histoire des capacités est nuancée. Les propres benchmarks publiés par SpaceXAI placent Grok 4.5 derrière Fable 5 et GPT-5.5 sur la plupart des évaluations de codage, bien qu'il devance Opus 4.8 sur DeepSWE 1.0, SWE Marathon et Terminal Bench 2.1. Entraîné avec des données d'interaction de l'IDE Cursor, Grok 4.5 est conçu pour l'utilisation d'outils de longue durée et l'ingénierie multi-étapes — pas pour repousser la frontière absolue sur les benchmarks de raisonnement brut.

Les réserves

Nous n'avons pas testé Grok 4.5 de manière indépendante. Chaque benchmark cité est rapporté par le fournisseur — même réserve que nous appliquons à chaque lancement de modèle. L'affirmation « classe Opus » de Musk est directionnellement exacte selon son propre cadrage nuancé (comparable à Opus 4.7, pas à l'actuel Opus 4.8), mais le modèle ne domine pas la frontière sur une quelconque métrique vérifiée indépendamment.

Le paysage concurrentiel est également une cible mouvante : GPT-5.6 Sol devrait être lancé publiquement aujourd'hui (9 juillet) (TechCrunch, 2026(s’ouvre dans un nouvel onglet)). Grok 4.5 entre sur un marché où la frontière est redéfinie en temps réel — et il n'est pas encore disponible dans l'UE (attendu mi-juillet).

FAQ

Grok 4.5 vaut-il la peine de changer maintenant ?

Pour le codage agentique sensible aux coûts, oui — la tarification à $2/$6 avec 80 TPS et une efficacité des tokens 4,2x supérieure à Opus 4.8 constitue une proposition de valeur convaincante. Pour les charges de travail critiques où une seule mauvaise réponse coûte cher, attendez les benchmarks indépendants.

Comment Grok 4.5 se compare-t-il réellement à Opus 4.8 ?

Les benchmarks rapportés par SpaceXAI montrent Grok 4.5 en retrait d'Opus 4.8 sur la plupart des évaluations de codage standard, mais en tête sur DeepSWE 1.0, SWE Marathon et Terminal Bench 2.1. Musk lui-même l'a qualifié de « à peu près comparable à Opus 4.7 » — pas à l'actuel Opus 4.8. La vérification indépendante est en attente.

Quand les benchmarks indépendants arriveront-ils ?

Aucun calendrier confirmé. Artificial Analysis et d'autres évaluateurs tiers publient généralement dans les jours suivant un lancement d'API publique. Nous mettrons à jour le verdict du répertoire quand ils seront disponibles.

Ce qui change pour vous

Si vous faites du codage agentique sensible aux coûts : La tarification $2/$6 de Grok 4.5 — associée à une vitesse de 80 TPS — en fait le modèle le moins cher dans la conversation proche de la frontière. Pour les équipes qui acheminent déjà des tâches à haut volume vers des niveaux budgétaires, Grok 4.5 offre des performances proches d'Opus sur les benchmarks de codage à une fraction du coût par token.

Si vous avez besoin de la meilleure capacité absolue : Ce n'est pas votre modèle. Fable 5 et Opus 4.8 dominent là où le raisonnement brut et la profondeur de codage de pointe comptent. Utilisez Grok 4.5 là où l'efficacité des tokens s'accumule sur de longues boucles d'agent — pas là où une seule mauvaise réponse coûte cher.

Si vous êtes dans l'UE : Attendez. La disponibilité est attendue mi-juillet mais non confirmée.

Notre position est claire : la tarification est réelle, le lancement est réel, et les chiffres d'efficacité des tokens — s'ils tiennent sous examen indépendant — sont l'argument le plus fort pour Grok 4.5 face à toutes les alternatives Anthropic et OpenAI. Ce qui manque, c'est la vérification par un tiers. Nous mettrons à jour le verdict quand les benchmarks indépendants arriveront.

Outils et modèles concernés

Ne ratez plus jamais une mise à jour

Le récap hebdomadaire — uniquement les changements de verdict et les actions urgentes. Sans remplissage.

En vous abonnant, vous acceptez notre Politique de confidentialité. Désabonnement à tout moment.