Grok 4.6 chega a $2/$6 — 61 no Índice AA, empata com o GPT-5.6 Sol

SpaceXAI logoSpaceXAIVeredicto alterado13 de agosto de 2026Modelos
O que aconteceu
SpaceXAI launched Grok 4.6 on Aug 12 at $2/$6, scoring 61 on the AA Intelligence Index — tying GPT-5.6 Sol for third, behind Claude Opus 5 and Claude Fable 5.
Porque é importante
It's frontier-competitive and the cheapest in its class — the model to watch for long-running agents and visual/interactive work.
O que fazer
Cursor and Grok Build users should try it now (2x included usage this week); everyone else, hold for broader benchmarks before betting production on it.

O Grok 4.6 foi lançado em 12 de agosto pelo mesmo $2 / $6 por 1M de tokens do Grok 4.5 — e a primeira leitura independente é forte: 61 no Índice de Inteligência da Artificial Analysis, um composto de nove benchmarks que empata com o GPT-5.6 Sol e fica atrás do Claude Opus 5 (63) e do Claude Fable 5 (62). Estamos movendo o veredito do diretório de pendente → condicional — não porque os benchmarks sejam fracos, mas porque um modelo lançado ontem ainda não ganhou recomendado.

O que aconteceu

A SpaceXAI lançou o Grok 4.6 com preços inalterados em relação ao Grok 4.5, mais uma "variante Fast" a 2x o preço para maior vazão. Os números principais (Artificial Analysis, 2026):

MétricaGrok 4.6GPT-5.6 SolFable 5 MaxGrok 4.5
Índice de Inteligência AA61616256
GDPVal-AA v21.7531.7281.7411.526
CursorBench v3.269,9%67,2%70,5%66,7%

A tabela acima compara um subconjunto de quatro modelos — o Claude Opus 5 (63) fica acima do Grok 4.6 no composto do Índice de Inteligência AA.

Três pontos se destacam:

  • GDPVal-AA 1.753 — atrás apenas do Claude Opus 5, à frente tanto do Fable 5 Max quanto do GPT-5.6 Sol.
  • Um salto de 5 pontos no composto sobre o Grok 4.5 (56 → 61) pelo mesmo preço.
  • Uso incluso em dobro no Grok Build e no Cursor na primeira semana — a SpaceXAI está pagando pela janela de avaliação.

Ele chega hoje no Cursor, Grok Build, na API, OpenRouter, Vercel e Cloudflare. O post de lançamento o posiciona para agentes de longa duração e trabalhos interativos/visuais mais ambiciosos: manter o foco ao longo de muitas etapas, além de estrutura de aplicativos e linguagem visual mais fortes na primeira passagem (xAI, 2026).

Por que isso importa

O Grok 4.6 é competitivo com a fronteira pelo menor preço da sua classe. Empatar com o GPT-5.6 Sol no composto — a $2/$6, inalterado em relação ao Grok 4.5 — redefine a matemática de custo por capacidade para cargas de agentes. Se a liderança no GDPVal-AA se mantiver, ele se torna a escolha padrão para equipes que gastam tokens com agentes de codificação.

Mas a verificação independente tem exatamente uma camada de avaliação. A Artificial Analysis é a única leitura de terceiros até agora. Um modelo lançado ontem não tem histórico de confiabilidade de longo horizonte — sem testes de estresse de agentes em múltiplas etapas, sem dados de conclusão de tarefas ao longo de vários dias. Essa é a lacuna entre condicional e recomendado, e uma pontuação composta do primeiro dia não a fecha.

O posicionamento é focado em agentes. O lançamento destaca a persistência ao longo de muitas etapas e a estrutura e os visuais na primeira passagem, voltado aos usuários do Cursor e do Grok Build — não uma aposta em assistente de propósito geral.

O que muda para você

No Cursor ou no Grok Build: teste esta semana. O uso incluso em dobro torna a avaliação quase gratuita, e os usuários do Grok 4.5 ganham um upgrade significativo pelo mesmo preço.

Apostando em produção: espere. Deixe o conjunto mais amplo de benchmarks chegar antes de encaminhar cargas críticas. Uma pontuação composta, por mais forte que seja, não é um histórico de confiabilidade.

Precisa de vazão: fique de olho na variante Fast. Ela roda a 2x o preço; vale a pena apenas se sua carga for limitada por latência, não por tokens.

FAQ

O que mudou entre o Grok 4.6 e o Grok 4.5?

Os preços seguem inalterados em $2/$6, mas o Grok 4.6 adiciona um salto de 5 pontos no composto (56 → 61), um resultado no GDPVal-AA atrás apenas do Claude Opus 5 e — segundo o post de lançamento — melhor persistência em tarefas de agentes de longa duração, além de estrutura de aplicativos e linguagem visual mais fortes na primeira passagem (xAI, 2026).

O Grok 4.6 é melhor que o GPT-5.6 Sol?

Eles empatam em 61 no Índice de Inteligência AA. O Grok 4.6 lidera sobre o GPT-5.6 Sol no GDPVal-AA (1.753 vs 1.728) e no CursorBench (69,9% vs 67,2%), enquanto o Claude Opus 5 (63) e o Claude Fable 5 (62) continuam à frente no composto. A $2/$6, o Grok 4.6 é o caminho mais barato para esse nível de capacidade — com um histórico muito menor.

Devo migrar cargas de produção para o Grok 4.6 agora?

Ainda não. Ele tem uma única camada de avaliação e um dia de vida. Avalie esta semana — especialmente no Cursor e no Grok Build com o uso incluso em dobro — e deixe os benchmarks agênticos e de longo horizonte independentes chegarem antes de tocar produção.

pendingescolha anterior
conditionalnova escolha

Launch completes the pending entity: 61 AA Intelligence Index (ties GPT-5.6 Sol, behind Claude Opus 5 and Claude Fable 5) at $2/$6, with GDPVal-AA behind only Claude Opus 5.

O que fazer

  1. 1 If you're on Cursor or Grok Build, try Grok 4.6 this week — the 2x included usage makes it a low-cost evaluation.
  2. 2 Hold production bets until the broader benchmark set lands; one evaluator (Artificial Analysis) is the only independent read so far.
  3. 3 Watch the 'Fast variant' at 2x price only if your workload is latency-bound, not token-bound.

Ferramentas e modelos afetados

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.