Grok 4.6 se lanza a $2/$6 — 61 en el índice AA, empata con GPT-5.6 Sol

SpaceXAI logoSpaceXAIVeredicto cambiado13 de agosto de 2026Modelos
Qué pasó
SpaceXAI launched Grok 4.6 on Aug 12 at $2/$6, scoring 61 on the AA Intelligence Index — tying GPT-5.6 Sol for third, behind Claude Opus 5 and Claude Fable 5.
Por qué importa
It's frontier-competitive and the cheapest in its class — the model to watch for long-running agents and visual/interactive work.
Qué hacer
Cursor and Grok Build users should try it now (2x included usage this week); everyone else, hold for broader benchmarks before betting production on it.

Grok 4.6 se lanzó el 12 de agosto con el mismo precio de $2 / $6 por 1M de tokens que Grok 4.5 — y la primera lectura independiente es contundente: 61 en el Artificial Analysis Intelligence Index, un compuesto de nueve benchmarks que empata con GPT-5.6 Sol y queda por detrás de Claude Opus 5 (63) y Claude Fable 5 (62). Estamos moviendo el veredicto del directorio de pendiente → condicional — no porque los benchmarks sean débiles, sino porque un modelo que salió ayer todavía no se ha ganado el recomendado.

Qué pasó

SpaceXAI lanzó Grok 4.6 con un precio sin cambios respecto a Grok 4.5, más una "variante Fast" al doble de precio para mayor rendimiento. Los números principales (Artificial Analysis, 2026):

MétricaGrok 4.6GPT-5.6 SolFable 5 MaxGrok 4.5
AA Intelligence Index61616256
GDPVal-AA v21.7531.7281.7411.526
CursorBench v3.269,9%67,2%70,5%66,7%

La tabla anterior compara un subconjunto de cuatro modelos — Claude Opus 5 (63) está por encima de Grok 4.6 en el índice compuesto AA Intelligence Index.

Destacan tres cosas:

  • GDPVal-AA 1.753 — solo por detrás de Claude Opus 5, por delante de Fable 5 Max y GPT-5.6 Sol.
  • Un salto de 5 puntos en el compuesto frente a Grok 4.5 (56 → 61) al mismo precio.
  • El doble de uso incluido en Grok Build y Cursor durante la primera semana — SpaceXAI está pagando por la ventana de evaluación.

Se lanza hoy en Cursor, Grok Build, la API, OpenRouter, Vercel y Cloudflare. La publicación de lanzamiento lo enmarca para agentes de larga duración y trabajo interactivo/visual más ambicioso: mantenerse en la tarea a lo largo de muchos pasos, y una estructura de aplicación y un lenguaje visual más sólidos al primer intento (xAI, 2026).

Por qué importa

Grok 4.6 es competitivo en la frontera al precio más bajo de su clase. Empatar con GPT-5.6 Sol en el índice compuesto — a $2/$6, sin cambios respecto a Grok 4.5 — reinicia la ecuación de costo por capacidad para cargas de trabajo de agentes. Si la ventaja en GDPVal-AA se mantiene, se convierte en la opción por defecto para equipos que queman tokens en agentes de programación.

Pero la verificación independiente se apoya exactamente en un solo evaluador. Artificial Analysis es la única lectura de terceros hasta ahora. Un modelo que salió ayer no tiene historial de fiabilidad a largo plazo — ni pruebas de estrés de agentes multi-paso, ni datos de finalización de tareas de varios días. Esa es la brecha entre condicional y recomendado, y un índice compuesto del día uno no la cierra.

El posicionamiento está centrado en agentes. El lanzamiento pone por delante la persistencia a lo largo de muchos pasos y la estructura y los visuales al primer intento, dirigido a usuarios de Cursor y Grok Build — no es una apuesta por un asistente de propósito general.

Qué cambia para ti

En Cursor o Grok Build: pruébalo esta semana. El doble de uso incluido lo convierte en una evaluación casi gratuita, y los usuarios de Grok 4.5 obtienen una mejora significativa al mismo precio.

Apostar en producción: espera. Deja que aterrice el conjunto más amplio de benchmarks antes de dirigirle cargas de trabajo críticas. Un índice compuesto, por fuerte que sea, no es un historial de fiabilidad.

¿Necesitas rendimiento? Vigila la variante Fast. Funciona al doble de precio; solo vale la pena si tu carga de trabajo está limitada por latencia, no por tokens.

FAQ

¿Qué cambió entre Grok 4.6 y Grok 4.5?

El precio no cambia en $2/$6, pero Grok 4.6 añade un salto de 5 puntos en el índice compuesto (56 → 61), un resultado en GDPVal-AA solo por detrás de Claude Opus 5 y — según la publicación de lanzamiento — mejor persistencia en tareas de agentes de larga duración y una estructura de aplicación y un lenguaje visual más sólidos al primer intento (xAI, 2026).

¿Es Grok 4.6 mejor que GPT-5.6 Sol?

Empatan con 61 en el AA Intelligence Index. Grok 4.6 supera a GPT-5.6 Sol en GDPVal-AA (1.753 frente a 1.728) y CursorBench (69,9% frente a 67,2%), mientras Claude Opus 5 (63) y Claude Fable 5 (62) siguen por delante en el índice compuesto. A $2/$6, Grok 4.6 es la ruta más barata a ese nivel de capacidad — con mucho menos historial.

¿Debo mover mis cargas de trabajo de producción a Grok 4.6 ahora?

Aún no. Tiene un solo evaluador y un solo día de vida. Evalúalo esta semana — especialmente en Cursor y Grok Build con el doble de uso incluido — y deja que aterricen los benchmarks independientes agénticos y de largo plazo antes de que toque producción.

pendingelección anterior
conditionalnueva elección

Launch completes the pending entity: 61 AA Intelligence Index (ties GPT-5.6 Sol, behind Claude Opus 5 and Claude Fable 5) at $2/$6, with GDPVal-AA behind only Claude Opus 5.

Qué hacer

  1. 1 If you're on Cursor or Grok Build, try Grok 4.6 this week — the 2x included usage makes it a low-cost evaluation.
  2. 2 Hold production bets until the broader benchmark set lands; one evaluator (Artificial Analysis) is the only independent read so far.
  3. 3 Watch the 'Fast variant' at 2x price only if your workload is latency-bound, not token-bound.

Herramientas y modelos afectados

No vuelvas a tener que ponerte al día

El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.

Al suscribirte aceptas nuestra Política de privacidad. Cancela cuando quieras.