Grok 4.5 Chega a $2/$6 — 60% Mais Barato que o Opus
- O que aconteceu
- SpaceXAI released Grok 4.5 on July 8 — its first post-IPO model — at $2/$6 per million tokens and 80 TPS. Trained alongside Cursor IDE data.
- Porque é importante
- At $2/$6, Grok 4.5 undercuts Opus 4.8 by 60%+ and GPT-5.6 Sol by 80% — the most aggressive frontier-adjacent pricing from any major lab this year. It resolves SWE Bench Pro with 4.2x fewer output tokens than Opus 4.8.
- O que fazer
- Cost-sensitive teams running agentic coding loops should evaluate Grok 4.5 now — the pricing is live and the token-efficiency advantage is real. Wait for independent benchmarks before routing mission-critical tasks. EU users: availability expected mid-July.
A SpaceXAI lançou o Grok 4.5 em 8 de julho — seu primeiro modelo desde que a empresa abriu capital no mês passado — e o preço é a verdadeira história. A $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída, o laboratório de Elon Musk está subcotando todos os concorrentes próximos da fronteira por uma margem ampla o suficiente para redefinir a conversa sobre custos para todo o mercado.
Nosso veredito: conditional. O Grok 4.5 está no diretório, e para o comprador certo — equipes sensíveis a custo rodando cargas de codificação agêntica — a proposta de valor é genuína. O porém: todo benchmark publicado é reportado pelo fornecedor, e o enquadramento "classe Opus" de Musk é dele mesmo. Verificação independente é o que separa um movimento de preços de uma recomendação de procurement.
Grok 4.5: o que a SpaceXAI entregou
A SpaceXAI publicou benchmarks na quarta-feira mostrando o Grok 4.5 competitivo com os principais modelos em programação, raciocínio e conhecimento geral — embora um pouco abaixo dos melhores da categoria na maioria das métricas (TechCrunch, 2026(abre num novo separador)). A empresa afirma ter "o dobro da eficiência de tokens" em relação a outros modelos líderes.
O preço é a manchete:
| Modelo | Entrada (por 1M) | Saída (por 1M) | Economia vs. Grok |
|---|---|---|---|
| Grok 4.5 | $2 | $6 | — |
| Claude Opus 4.7 | $5 | $25 | 60% / 76% |
| GPT-5.6 Sol | $5 | $30 | 60% / 80% |
| GPT-5.6 Luna | $1 | $6 | -100% / 0% |
Musk caracterizou o Grok 4.5 como "aproximadamente comparável ao Opus 4.7, mas muito mais rápido" em um post de follow-up no X(abre num novo separador). "A combinação de capacidade, maior velocidade e menor custo é o que o torna competitivo."
A SpaceXAI diz que o forte feedback positivo do seu programa de teste beta levou ao lançamento público acelerado em 9 de julho.
Por que isso importa
Este é o preço mais agressivo de um grande laboratório de IA neste ano. A SpaceXAI (anteriormente xAI) agora é uma empresa de capital aberto com acesso aos mercados de capitais. Um modelo credível próximo da fronteira a $2/$6 — subcotando o flagship da Anthropic em 60% e o Sol da OpenAI em 80% — força a mão de preços de todos os concorrentes.
Os números de eficiência de tokens são impressionantes: o Grok 4.5 resolve tarefas do SWE Bench Pro com ~16K tokens de saída contra 67K do Opus 4.8 — uma vantagem de 4,2x. Para equipes rodando loops extensivos de codificação agêntica onde os custos de token se acumulam, essa lacuna de eficiência é dinheiro real (SpaceXAI, 2026(abre num novo separador)).
Mas a história de capacidade é matizada. Os próprios benchmarks publicados pela SpaceXAI colocam o Grok 4.5 atrás do Fable 5 e GPT-5.5 na maioria das avaliações de programação, embora lidere sobre o Opus 4.8 no DeepSWE 1.0, SWE Marathon e Terminal Bench 2.1. Treinado com dados de interação do Cursor IDE, o Grok 4.5 é projetado especificamente para uso prolongado de ferramentas e engenharia multi-etapas — não para alcançar a fronteira absoluta em benchmarks de raciocínio bruto.
As ressalvas
Não testamos o Grok 4.5 de forma independente. Todo benchmark citado é reportado pelo fornecedor — mesma ressalva que aplicamos a todo lançamento de modelo. A afirmação de Musk de "classe Opus" é direcionalmente precisa pelo seu próprio enquadramento qualificado (comparável ao Opus 4.7, não ao Opus 4.8 atual), mas o modelo não lidera a fronteira em nenhuma métrica verificada de forma independente.
O cenário competitivo também é um alvo móvel: espera-se que o GPT-5.6 Sol seja lançado publicamente hoje (9 de julho) (TechCrunch, 2026(abre num novo separador)). O Grok 4.5 entra em um mercado onde a fronteira está sendo redefinida em tempo real — e ainda não está disponível na UE (previsão para meados de julho).
FAQ
Vale a pena migrar para o Grok 4.5 agora?
Para codificação agêntica com sensibilidade a custo, sim — preço de $2/$6 com 80 TPS e eficiência de tokens 4,2x superior ao Opus 4.8 é uma proposta de valor convincente. Para cargas de trabalho de missão crítica onde uma única resposta errada custa caro, aguarde benchmarks independentes.
Como o Grok 4.5 realmente se compara ao Opus 4.8?
Os benchmarks reportados pela SpaceXAI mostram o Grok 4.5 atrás do Opus 4.8 na maioria das avaliações padrão de programação, mas liderando no DeepSWE 1.0, SWE Marathon e Terminal Bench 2.1. O próprio Musk qualificou como "aproximadamente comparável ao Opus 4.7" — não ao Opus 4.8 atual. Verificação independente está pendente.
Quando chegarão os benchmarks independentes?
Nenhum prazo confirmado. Artificial Analysis e outros avaliadores terceirizados tipicamente publicam dias após o lançamento público da API. Atualizaremos o veredito do diretório quando eles chegarem.
O que muda para você
Se você roda codificação agêntica com sensibilidade a custo: O preço de $2/$6 do Grok 4.5 — combinado com velocidade de 80 TPS — o torna o modelo mais barato na conversa do segmento próximo da fronteira. Para equipes que já roteiam tarefas de alto volume para níveis de orçamento, o Grok 4.5 oferece desempenho próximo ao Opus em benchmarks de programação a uma fração do custo por token.
Se você precisa da melhor capacidade absoluta: Este não é o seu modelo. Fable 5 e Opus 4.8 lideram onde raciocínio bruto e profundidade de programação de fronteira importam. Use o Grok 4.5 onde a eficiência de tokens se acumula em loops longos de agente — não onde uma única resposta errada custa caro.
Se você está na UE: Aguarde. Disponibilidade prevista para meados de julho, mas não confirmada.
Nossa posição é clara: o preço é real, o lançamento é real, e os números de eficiência de tokens — se resistirem ao escrutínio independente — são o argumento mais forte para o Grok 4.5 sobre qualquer alternativa da Anthropic e OpenAI. O que falta é verificação independente. Atualizaremos o veredito quando os benchmarks independentes chegarem.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.