G

Grok 4.5

SpaceXAI · Lanzado jul 2026

Condicional

Modelo de programación agéntica con precio competitivo a $2/$6 por 1M tokens y 500K de contexto: los benchmarks publicados por xAI lo sitúan en la zona media, por detrás de Fable 5 y GPT-5.5, aunque supera a Opus 4.8 en DeepSWE y Terminal-Bench 2.1. La verdadera noticia es la eficiencia de coste: 4.2× más eficiente en tokens que Opus 4.8 en SWE-Bench Pro. Ideal para equipos que necesitan programación sólida a una fracción del precio de los modelos punteros. Aún no disponible en la UE.

¿Es adecuada para ti?

Bueno para

  • Cargas de programación con sensibilidad al coste: precios de $2/$6, un 60% menos en entrada y un 76% menos en salida que Opus
  • Tareas agénticas con eficiencia de tokens: resuelve SWE Bench Pro con ~16K tokens de salida, 4.2x menos que Opus 4.8
  • Uso de herramientas de larga duración e ingeniería multi-paso: entrenado junto a Cursor para flujos de programación agéntica
  • Productividad ofimática: integración nativa con Excel, PowerPoint y Word mediante Grok Build

No recomendado para

  • Equipos que necesitan la frontera absoluta: Fable 5 y GPT-5.5 lideran en la mayoría de benchmarks de programación
  • Proyectos con sede en la UE: aún no disponible en regiones de la UE (previsto para mediados de julio de 2026)
  • Cargas de trabajo que requieren verificación independiente de benchmarks: todas las puntuaciones actuales son reportadas por el proveedor

Rendimiento por tarea

Generación de código

Very Good

Sólido en SWE Bench Pro (64.7%) y Terminal Bench 2.1 (83.3%); en la zona media entre los modelos de frontera

Programación agéntica

Very Good

Diseñado para uso de herramientas de larga duración con datos de entrenamiento de Cursor; ventaja de eficiencia de tokens de 4.2x

Trabajo de conocimiento

Good

Correcto pero por detrás de Opus 4.8 y Fable 5 en benchmarks de conocimiento según los gráficos del proveedor

Razonamiento

Good

Esfuerzo de razonamiento configurable (bajo/medio/alto); adecuado pero no líder en su clase

Multimodal

Good

Entrada de texto + imagen, solo salida de texto; sin generación de imágenes nativa

Precios

Entrada

$2 / 1M tokens

Salida

$6 / 1M tokens

Contexto

500K tokens

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
DeepSWE 1.062.0% Fuente
DeepSWE 1.153% Fuente
SWE Marathon29.0% Fuente
Terminal Bench 2.183.3% Fuente
SWE Bench Pro64.7% Fuente

Historial de veredictos

15 jul 2026
copy edit to brevity standard — detail preserved in existing structured children

Registro de verificación

  • Precios— Sin cambios

    Agente automatizado

  • Precios— Sin cambios

    Agente automatizado

  • Perfil— Sin cambios

    Importado en el lanzamiento

  • Precios— Sin cambios

    Importado en el lanzamiento

Cómo evaluamos