Grok 4.5 Llega a $2/$6 — Reduce a Opus en un 60%

SpaceXAI logoSpaceXAIImportante9 de julio de 2026Modelos
Qué pasó
SpaceXAI released Grok 4.5 on July 8 — its first post-IPO model — at $2/$6 per million tokens and 80 TPS. Trained alongside Cursor IDE data.
Por qué importa
At $2/$6, Grok 4.5 undercuts Opus 4.8 by 60%+ and GPT-5.6 Sol by 80% — the most aggressive frontier-adjacent pricing from any major lab this year. It resolves SWE Bench Pro with 4.2x fewer output tokens than Opus 4.8.
Qué hacer
Cost-sensitive teams running agentic coding loops should evaluate Grok 4.5 now — the pricing is live and the token-efficiency advantage is real. Wait for independent benchmarks before routing mission-critical tasks. EU users: availability expected mid-July.

SpaceXAI lanzó Grok 4.5 el 8 de julio — su primer modelo desde que la empresa salió a bolsa el mes pasado — y el precio es la verdadera noticia. A $2 por millón de tokens de entrada y $6 por millón de tokens de salida, el laboratorio de Elon Musk está socavando a todos los competidores cercanos a la frontera por un margen lo suficientemente amplio como para redefinir la conversación de costos para todo el mercado.

Nuestro veredicto: conditional. Grok 4.5 está en el directorio, y para el comprador adecuado — equipos sensibles al costo que ejecutan flujos de codificación agéntica — la propuesta de valor es genuina. El obstáculo: todos los benchmarks publicados son reportados por el fabricante, y el encuadre de Musk de "clase Opus" es su propia narrativa. La verificación independiente es lo que separa un movimiento de precios de una recomendación de adquisición.

Grok 4.5: lo que SpaceXAI lanzó

SpaceXAI publicó benchmarks el miércoles que muestran a Grok 4.5 competitivo con los modelos líderes en tareas de programación, razonamiento y conocimiento general — aunque justo por debajo del mejor de su clase en la mayoría de las métricas (TechCrunch, 2026(se abre en una pestaña nueva)). La empresa afirma tener "el doble de eficiencia de tokens" que otros modelos líderes.

El precio es el titular:

ModeloEntrada (por 1M)Salida (por 1M)Ahorro con Grok
Grok 4.5$2$6
Claude Opus 4.7$5$2560% / 76%
GPT-5.6 Sol$5$3060% / 80%
GPT-5.6 Luna$1$6-100% / 0%

Musk caracterizó a Grok 4.5 como "aproximadamente comparable a Opus 4.7, pero mucho más rápido" en una publicación de seguimiento en X(se abre en una pestaña nueva). "La combinación de capacidad, mayor velocidad y menor costo es lo que lo hace competitivo."

SpaceXAI afirma que los fuertes comentarios positivos de su programa de pruebas beta llevaron al lanzamiento público acelerado el 9 de julio.

Por qué importa

Este es el precio más agresivo de un laboratorio de IA importante este año. SpaceXAI (antes xAI) es ahora una empresa que cotiza en bolsa con acceso a los mercados de capital. Un modelo creíble cercano a la frontera a $2/$6 — un 60% más barato que el buque insignia de Anthropic y un 80% menos que Sol de OpenAI — fuerza la mano de precios de todos los competidores.

Las cifras de eficiencia de tokens son impactantes: Grok 4.5 resuelve tareas de SWE Bench Pro con ~16K tokens de salida frente a los 67K de Opus 4.8 — una ventaja de 4.2x. Para equipos que ejecutan bucles extensos de codificación agéntica donde los costos de tokens se acumulan, esa brecha de eficiencia es dinero real (SpaceXAI, 2026(se abre en una pestaña nueva)).

Pero la historia de capacidades tiene matices. Los propios benchmarks publicados por SpaceXAI sitúan a Grok 4.5 detrás de Fable 5 y GPT-5.5 en la mayoría de las evaluaciones de programación, aunque lidera frente a Opus 4.8 en DeepSWE 1.0, SWE Marathon y Terminal Bench 2.1. Entrenado junto con datos de interacción de Cursor IDE, Grok 4.5 está diseñado para uso prolongado de herramientas e ingeniería de múltiples pasos — no para empujar la frontera absoluta en benchmarks de razonamiento puro.

Las salvedades

No hemos probado Grok 4.5 de forma independiente. Cada benchmark citado es reportado por el fabricante — la misma salvedad que aplicamos a cada lanzamiento de modelo. La afirmación de Musk de "clase Opus" es direccionalmente precisa según su propio encuadre matizado (comparable a Opus 4.7, no al actual Opus 4.8), pero el modelo no lidera la frontera en ninguna métrica verificada de forma independiente.

El panorama competitivo también es un blanco móvil: se espera que GPT-5.6 Sol se lance públicamente hoy (9 de julio) (TechCrunch, 2026(se abre en una pestaña nueva)). Grok 4.5 entra en un mercado donde la frontera se está redefiniendo en tiempo real — y aún no está disponible en la UE (previsto para mediados de julio).

FAQ

¿Vale la pena cambiarse a Grok 4.5 ahora mismo?

Para quienes trabajan con codificación agéntica y el presupuesto es una prioridad, sí — precios de $2/$6 con 80 TPS y 4.2x de eficiencia de tokens sobre Opus 4.8 es una propuesta de valor convincente. Para cargas de trabajo críticas donde una sola respuesta incorrecta es costosa, espera benchmarks independientes.

¿Cómo se compara realmente Grok 4.5 con Opus 4.8?

Los benchmarks reportados por SpaceXAI muestran a Grok 4.5 por detrás de Opus 4.8 en la mayoría de las evaluaciones de programación estándar, pero liderando en DeepSWE 1.0, SWE Marathon y Terminal Bench 2.1. El propio Musk lo calificó como "aproximadamente comparable a Opus 4.7" — no al actual Opus 4.8. La verificación independiente está pendiente.

¿Cuándo llegarán los benchmarks independientes?

Sin plazo confirmado. Artificial Analysis y otros evaluadores externos suelen publicar a los pocos días de un lanzamiento público de API. Actualizaremos el veredicto del directorio cuando lleguen.

Qué cambia para ti

Si trabajas con codificación agéntica y el presupuesto es una prioridad: Los precios de $2/$6 de Grok 4.5 — combinados con velocidad de 80 TPS — lo convierten en el modelo más barato en la conversación cercana a la frontera. Para equipos que ya enrutan tareas de alto volumen a niveles de presupuesto, Grok 4.5 ofrece rendimiento cercano a Opus en benchmarks de programación a una fracción del costo por token.

Si necesitas la mejor capacidad absoluta: Este no es tu modelo. Fable 5 y Opus 4.8 lideran donde importan el razonamiento puro y la profundidad de programación de vanguardia. Usa Grok 4.5 donde la eficiencia de tokens se acumula en bucles largos de agente — no donde una sola respuesta incorrecta es costosa.

Si estás en la UE: Espera. La disponibilidad se prevé para mediados de julio pero no está confirmada.

Nuestra postura es clara: el precio es real, el lanzamiento es real, y las cifras de eficiencia de tokens — si se mantienen bajo escrutinio independiente — son el argumento más fuerte a favor de Grok 4.5 frente a todas las alternativas de Anthropic y OpenAI. Lo que falta es verificación de terceros. Actualizaremos el veredicto cuando lleguen los benchmarks independientes.

Herramientas y modelos afectados

No vuelvas a tener que ponerte al día

El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.

Al suscribirte aceptas nuestra Política de privacidad. Cancela cuando quieras.