Claude Sonnet 5 é lançado: poder quase de Opus, custo elevado de tokens
- O que aconteceu
- Anthropic launched Claude Sonnet 5 on June 30 — near-Opus 4.8 agentic performance at Sonnet pricing, now the default model for all plans.
- Porque é importante
- A new tokenizer produces ~30% more tokens for English input, making the headline price misleading — effective costs are up even though per-token rates are flat. temperature, top_p, and top_k are gone.
- O que fazer
- Upgrade from Sonnet 4.6: yes, the capability jump is worth it. Budget for agent workloads: factor in ~30% more tokens. Migrate any code relying on temperature/top_p/top_k sampler parameters.
A Anthropic lançou o Claude Sonnet 5 em 30 de junho, tornando-o o modelo padrão em todos os planos Free e Pro. Nosso veredito: recommended. O salto de capacidade agentiva em relação ao Claude 4 Sonnet é inequívoco — ele conclui tarefas complexas de múltiplas etapas nas quais seu antecessor travava, verifica sua própria saída sem solicitação e reduz a diferença para o Opus 4.8 a uma margem mínima. Mas reserve orçamento para um aumento de ~30% na contagem de tokens devido ao novo tokenizador, e migre qualquer código que dependa de temperature, top_p ou top_k — esses parâmetros foram removidos.
O que aconteceu
O Claude Sonnet 5 reduz a lacuna de desempenho com o Opus 4.8 à menor margem já vista. Em níveis de esforço médio, ele entrega a mesma qualidade de saída por menos dinheiro. Em configurações de esforço mais alto — o tipo que agentes usam para trabalho sustentado de múltiplas etapas — ele pode igualar o Opus 4.8 em busca agentiva (BrowseComp: 84,7%) e uso de computador (OSWorld-Verified: 81,2%).
O número principal é um salto de 13,4 pontos no Terminal-Bench 2.1 sobre o Claude 4 Sonnet. Parceiros de acesso antecipado ecoam os benchmarks: a Stripe o chamou de «uma forte camada de execução para trabalho de engenharia de software em múltiplas etapas». O cofundador da Lovable relatou «mesma qualidade de saída, menos etapas para chegar lá».
O porém, divulgado honestamente pela Anthropic em uma nota de rodapé: um novo tokenizador mapeia a mesma entrada para cerca de 1,0 a 1,35x mais tokens. O preço por token parece estável — $2/$10 promocional (até 31 de agosto), depois $3/$15 padrão — mas quando uma chamada que usava 5.000 tokens agora precisa de 7.000 tokens, sua conta sobe 40% mesmo que a tabela de preços tenha permanecido igual.
Em uma ruptura clara, o Sonnet 5 não oferece mais suporte a temperature, top_p ou top_k na API ou no Workbench. A Anthropic tem migrado para controle baseado em esforço (low/medium/high/extra-high) em vez de parâmetros tradicionais de amostragem.
Por que isso importa
Este é o modelo que a Anthropic quer que empresas usem para executar agentes. É o cavalo de batalha da classe Sonnet — próximo o suficiente do Opus 4.8 para que muitas cargas de trabalho não precisem do tier mais caro, mas barato o suficiente para evitar que orçamentos de agentes saiam do controle.
A questão do tokenizador não é um impeditivo, mas é uma armadilha orçamentária para times que estão escalando cargas de trabalho agentivas de forma agressiva. As tarifas por token são a métrica errada agora — conte tokens por tarefa antes e depois da migração.
O que muda para você
Se você está no Claude 4 Sonnet, atualize — o salto de capacidade é real e o preço promocional o torna neutro em custo até agosto. Se você executa cargas de trabalho agentivas em escala, recalcule seus orçamentos de tokens antes de migrar. Se suas chamadas de API passam temperature, top_p ou top_k, remova-os — esses parâmetros não funcionam mais no Sonnet 5.
FAQ
P: Por que a mudança do tokenizador importa se o preço por token permaneceu igual? Um novo tokenizador divide o texto em mais pedaços — cerca de 30% mais para entrada em inglês. Seu custo por chamada é contagem de tokens × tarifa por token, então se a contagem de tokens sobe 30%, sua conta sobe 30% mesmo que a tabela de preços pareça inalterada.
P: O que substitui temperature, top_p e top_k? O controle baseado em esforço da Anthropic: configure o thinking com níveis de esforço (low/medium/high/extra-high) em vez de parâmetros tradicionais de amostragem.
P: Travar o preço promocional ou esperar pelas tarifas padrão em setembro? Trave agora. O preço promocional de $2/$10 por milhão de tokens economiza cerca de 33% em relação às tarifas padrão de $3/$15.
O que fazer
- 1 Audit agent token budgets: the new tokenizer adds ~30% tokens for English input — your per-call costs will rise even if per-token rates look flat
- 2 Remove temperature/top_p/top_k from API calls — these parameters are no longer supported on Sonnet 5
- 3 Lock in introductory pricing: $2/$10 through Aug 31, then $3/$15 standard — plan migration timelines accordingly
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.