G

Grok 4.5

SpaceXAI · Lançado 07/2026

Condicional

Modelo de codificação agêntica com preço competitivo a $2/$6 por 1M de tokens com 500K de contexto — os benchmarks publicados pela xAI o colocam no meio do pelotão, atrás do Fable 5 e GPT-5.5, embora lidere sobre o Opus 4.8 no DeepSWE e Terminal-Bench 2.1. O destaque real é a eficiência de custo: 4,2× mais eficiente em tokens que o Opus 4.8 no SWE-Bench Pro. Ideal para equipes que precisam de codificação forte por uma fração do preço de ponta. Ainda não disponível na UE.

É adequada para ti?

Bom para

  • Cargas de trabalho de código sensíveis ao custo — preço de $2/$6 reduz o Opus em 60% na entrada, 76% na saída
  • Tarefas agênticas eficientes em tokens — resolve SWE Bench Pro com ~16K tokens de saída, 4,2x menos que o Opus 4.8
  • Uso de ferramentas de longa duração e engenharia multi-etapa — treinado em conjunto com o Cursor para fluxos de trabalho de codificação agêntica
  • Produtividade de escritório — integração nativa com Excel, PowerPoint, Word via Grok Build

Não recomendado para

  • Equipas que precisam da fronteira absoluta — Fable 5 e GPT-5.5 lideram na maioria dos benchmarks de codificação
  • Projetos sediados na UE — ainda não disponível em regiões da UE (previsto para meados de julho de 2026)
  • Cargas de trabalho que exigem verificação independente de benchmarks — todas as pontuações atuais são fornecidas pelo fornecedor

Desempenho por tarefa

Geração de código

Very Good

Forte no SWE Bench Pro (64,7%) e Terminal Bench 2.1 (83,3%); meio do pelotão entre os modelos de fronteira

Codificação agêntica

Very Good

Concebido para uso de ferramentas de longa duração com dados de treino do Cursor; vantagem de eficiência de tokens de 4,2x

Trabalho de conhecimento

Good

Sólido mas fica atrás do Opus 4.8 e Fable 5 nos benchmarks de conhecimento segundo os gráficos do fornecedor

Raciocínio

Good

Esforço de raciocínio configurável (baixo/médio/alto); adequado mas não líder da classe

Multimodal

Good

Entrada de texto + imagem, apenas saída de texto; sem geração de imagem nativamente

Preços

Entrada

$2 / 1M tokens

Saída

$6 / 1M tokens

Contexto

500K tokens

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
DeepSWE 1.062.0% Fonte
DeepSWE 1.153% Fonte
SWE Marathon29.0% Fonte
Terminal Bench 2.183.3% Fonte
SWE Bench Pro64.7% Fonte

Histórico de veredictos

15/07/2026
copy edit to brevity standard — detail preserved in existing structured children

Registo de verificação

  • Preços— Sem alterações

    Agente automatizado

  • Preços— Sem alterações

    Agente automatizado

  • Perfil— Sem alterações

    Importado no lançamento

  • Preços— Sem alterações

    Importado no lançamento

Como avaliamos