G

Grok 4.5

SpaceXAI · Sorti juil. 2026

Conditionnel

Modèle de codage agentique à prix compétitif à 2 $ / 6 $ par million de tokens avec 500K de contexte — les benchmarks publiés par xAI le placent en milieu de peloton derrière Fable 5 et GPT-5.5, même s'il devance Opus 4.8 sur DeepSWE et Terminal-Bench 2.1. Ce qui compte vraiment, c'est le rapport coût-efficacité : 4,2x plus efficient en tokens qu'Opus 4.8 sur SWE-Bench Pro. Idéal pour les équipes qui ont besoin de codage performant à une fraction des tarifs de pointe. Pas encore disponible dans l'UE.

Est-ce fait pour vous ?

Recommandé pour

  • Charges de codage sensibles aux coûts — la tarification $2/$6 réduit le coût de 60% en entrée et 76% en sortie par rapport à Opus
  • Tâches agentiques économes en tokens — résout SWE Bench Pro avec environ 16K tokens de sortie, 4,2x moins qu'Opus 4.8
  • Utilisation d'outils longue durée et ingénierie multi-étapes — entraîné avec Cursor pour les workflows de codage agentique
  • Productivité bureautique — intégration native Excel, PowerPoint, Word via Grok Build

Déconseillé pour

  • Équipes ayant besoin du niveau frontière absolu — Fable 5 et GPT-5.5 dominent sur la plupart des benchmarks de codage
  • Projets basés dans l'UE — pas encore disponible dans les régions de l'UE (prévu mi-juillet 2026)
  • Charges nécessitant une vérification indépendante des benchmarks — tous les scores actuels sont rapportés par le fournisseur

Performances par tâche

Génération de code

Very Good

Solide sur SWE Bench Pro (64,7%) et Terminal Bench 2.1 (83,3%) ; milieu de peloton parmi les modèles frontière

Codage agentique

Very Good

Conçu pour l'utilisation d'outils longue durée avec données d'entraînement Cursor ; avantage d'efficacité en tokens de 4,2x

Travail de connaissance

Good

Solide mais derrière Opus 4.8 et Fable 5 sur les benchmarks de connaissance selon les graphiques du fournisseur

Raisonnement

Good

Effort de raisonnement configurable (low/medium/high) ; adéquat mais pas en tête de classe

Multimodal

Good

Entrée texte + image, sortie texte uniquement ; pas de génération d'image native

Tarifs

Entrée

$2 / 1M tokens

Sortie

$6 / 1M tokens

Contexte

500K tokens

Voir tous les tarifs

Tests de performance

TestScoreSource
DeepSWE 1.062.0% Source
DeepSWE 1.153% Source
SWE Marathon29.0% Source
Terminal Bench 2.183.3% Source
SWE Bench Pro64.7% Source

Historique des verdicts

15 juil. 2026
copy edit to brevity standard — detail preserved in existing structured children

Journal de vérification

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

  • Profil— Aucun changement

    Importé au lancement

  • Tarifs— Aucun changement

    Importé au lancement

Comment nous évaluons