Grok 4.6 chega a $2/$6 — 61 no Índice AA, empata com o GPT-5.6 Sol
- O que aconteceu
- SpaceXAI launched Grok 4.6 on Aug 12 at $2/$6, scoring 61 on the AA Intelligence Index — tying GPT-5.6 Sol for third, behind Claude Opus 5 and Claude Fable 5.
- Porque é importante
- It's frontier-competitive and the cheapest in its class — the model to watch for long-running agents and visual/interactive work.
- O que fazer
- Cursor and Grok Build users should try it now (2x included usage this week); everyone else, hold for broader benchmarks before betting production on it.
O Grok 4.6 foi lançado em 12 de agosto pelo mesmo $2 / $6 por 1M de tokens do Grok 4.5 — e a primeira leitura independente é forte: 61 no Índice de Inteligência da Artificial Analysis, um composto de nove benchmarks que empata com o GPT-5.6 Sol e fica atrás do Claude Opus 5 (63) e do Claude Fable 5 (62). Estamos movendo o veredito do diretório de pendente → condicional — não porque os benchmarks sejam fracos, mas porque um modelo lançado ontem ainda não ganhou recomendado.
O que aconteceu
A SpaceXAI lançou o Grok 4.6 com preços inalterados em relação ao Grok 4.5, mais uma "variante Fast" a 2x o preço para maior vazão. Os números principais (Artificial Analysis, 2026):
| Métrica | Grok 4.6 | GPT-5.6 Sol | Fable 5 Max | Grok 4.5 |
|---|---|---|---|---|
| Índice de Inteligência AA | 61 | 61 | 62 | 56 |
| GDPVal-AA v2 | 1.753 | 1.728 | 1.741 | 1.526 |
| CursorBench v3.2 | 69,9% | 67,2% | 70,5% | 66,7% |
A tabela acima compara um subconjunto de quatro modelos — o Claude Opus 5 (63) fica acima do Grok 4.6 no composto do Índice de Inteligência AA.
Três pontos se destacam:
- GDPVal-AA 1.753 — atrás apenas do Claude Opus 5, à frente tanto do Fable 5 Max quanto do GPT-5.6 Sol.
- Um salto de 5 pontos no composto sobre o Grok 4.5 (56 → 61) pelo mesmo preço.
- Uso incluso em dobro no Grok Build e no Cursor na primeira semana — a SpaceXAI está pagando pela janela de avaliação.
Ele chega hoje no Cursor, Grok Build, na API, OpenRouter, Vercel e Cloudflare. O post de lançamento o posiciona para agentes de longa duração e trabalhos interativos/visuais mais ambiciosos: manter o foco ao longo de muitas etapas, além de estrutura de aplicativos e linguagem visual mais fortes na primeira passagem (xAI, 2026).
Por que isso importa
O Grok 4.6 é competitivo com a fronteira pelo menor preço da sua classe. Empatar com o GPT-5.6 Sol no composto — a $2/$6, inalterado em relação ao Grok 4.5 — redefine a matemática de custo por capacidade para cargas de agentes. Se a liderança no GDPVal-AA se mantiver, ele se torna a escolha padrão para equipes que gastam tokens com agentes de codificação.
Mas a verificação independente tem exatamente uma camada de avaliação. A Artificial Analysis é a única leitura de terceiros até agora. Um modelo lançado ontem não tem histórico de confiabilidade de longo horizonte — sem testes de estresse de agentes em múltiplas etapas, sem dados de conclusão de tarefas ao longo de vários dias. Essa é a lacuna entre condicional e recomendado, e uma pontuação composta do primeiro dia não a fecha.
O posicionamento é focado em agentes. O lançamento destaca a persistência ao longo de muitas etapas e a estrutura e os visuais na primeira passagem, voltado aos usuários do Cursor e do Grok Build — não uma aposta em assistente de propósito geral.
O que muda para você
No Cursor ou no Grok Build: teste esta semana. O uso incluso em dobro torna a avaliação quase gratuita, e os usuários do Grok 4.5 ganham um upgrade significativo pelo mesmo preço.
Apostando em produção: espere. Deixe o conjunto mais amplo de benchmarks chegar antes de encaminhar cargas críticas. Uma pontuação composta, por mais forte que seja, não é um histórico de confiabilidade.
Precisa de vazão: fique de olho na variante Fast. Ela roda a 2x o preço; vale a pena apenas se sua carga for limitada por latência, não por tokens.
FAQ
O que mudou entre o Grok 4.6 e o Grok 4.5?
Os preços seguem inalterados em $2/$6, mas o Grok 4.6 adiciona um salto de 5 pontos no composto (56 → 61), um resultado no GDPVal-AA atrás apenas do Claude Opus 5 e — segundo o post de lançamento — melhor persistência em tarefas de agentes de longa duração, além de estrutura de aplicativos e linguagem visual mais fortes na primeira passagem (xAI, 2026).
O Grok 4.6 é melhor que o GPT-5.6 Sol?
Eles empatam em 61 no Índice de Inteligência AA. O Grok 4.6 lidera sobre o GPT-5.6 Sol no GDPVal-AA (1.753 vs 1.728) e no CursorBench (69,9% vs 67,2%), enquanto o Claude Opus 5 (63) e o Claude Fable 5 (62) continuam à frente no composto. A $2/$6, o Grok 4.6 é o caminho mais barato para esse nível de capacidade — com um histórico muito menor.
Devo migrar cargas de produção para o Grok 4.6 agora?
Ainda não. Ele tem uma única camada de avaliação e um dia de vida. Avalie esta semana — especialmente no Cursor e no Grok Build com o uso incluso em dobro — e deixe os benchmarks agênticos e de longo horizonte independentes chegarem antes de tocar produção.
Launch completes the pending entity: 61 AA Intelligence Index (ties GPT-5.6 Sol, behind Claude Opus 5 and Claude Fable 5) at $2/$6, with GDPVal-AA behind only Claude Opus 5.
O que fazer
- 1 If you're on Cursor or Grok Build, try Grok 4.6 this week — the 2x included usage makes it a low-cost evaluation.
- 2 Hold production bets until the broader benchmark set lands; one evaluator (Artificial Analysis) is the only independent read so far.
- 3 Watch the 'Fast variant' at 2x price only if your workload is latency-bound, not token-bound.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.