Gemini 3.7 Flash logo

Gemini 3.7 Flash

Google · Lançado 08/2026

Recomendado

O Gemini 3.7 Flash é o cavalo de batalha Flash mais forte do Google até agora para código e agentes — um avanço genuíno em relação ao 3.6 Flash pela metade do preço anterior até 2026. Ele ainda fica atrás da fronteira nas tarefas mais difíceis de terminal e uso de computador. Um upgrade claro para construtores de agentes sensíveis a custo e do ecossistema Google; não é um substituto de código de fronteira.

É adequada para ti?

Bom para

  • Cargas de trabalho de código e agentes sensíveis a custo — o preço de lançamento de $0.75/$3.75 é cerca de um terço do custo combinado do Claude Sonnet 5 ou do GPT-5.6 Terra
  • Engenharia de software de longo horizonte — DeepSWE v1.1 65,3%, acima dos 49,0% do 3.6 Flash
  • Desenvolvimento web — Code Arena Elo 1588, topo da tabela comparativa do Google, com melhor aderência ao design system em menos prompts
  • Construtores de agentes do ecossistema Google — alimenta o Gemini Spark; disponível via Gemini API, AI Studio, Android Studio e Antigravity

Não recomendado para

  • Código agêntico/de terminal mais difícil onde os modelos de fronteira lideram — o GPT-5.6 Terra está à frente no DeepSWE (69,6%), no Terminal-Bench 2.1 (87,4%) e no OSWorld-2.0
  • Times que precisam de estabilidade de preço além de 2026 — a taxa de lançamento expira em 31 de dez de 2026, depois dobra para $1.50/$7.50

Desempenho por tarefa

Software engineering (DeepSWE v1.1)

Very Good

65,3% no DeepSWE v1.1, um grande ganho sobre os 49,0% do 3.6 Flash, mas ainda atrás dos 69,6% do GPT-5.6 Terra

Production code quality (FrontierCode 1.1 Main)

Very Good

43,6% vs 34,4% do 3.6 Flash; lidera sobre o GPT-5.6 Terra na tabela do Google

Terminal/CLI agent work (Terminal-Bench 2.1)

Very Good

85,8% no Terminal-Bench 2.1, logo atrás dos 87,4% do GPT-5.6 Terra

Web development (Code Arena)

Excellent

1588 Elo no Code Arena — maior pontuação na tabela comparativa do Google

Knowledge work / long context

Very Good

Contexto de 1M, 97,0% no teste de agulha de contexto longo de 128K; GDPval-AA 1525 Elo fica atrás dos 1598 do Sonnet 5

Preços

Entrada

$0.75 / 1M

Saída

$3.75 / 1M

Contexto

1M context, 64K output

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
DeepSWE v1.165.3% Fonte
FrontierCode 1.1 Main43.6% Fonte
Terminal-Bench 2.185.8% Fonte
Code Arena (Web Dev) Elo1588 Fonte
Artificial Analysis Intelligence Index56 Fonte

Ainda sem alterações de veredicto

O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.

Registo de verificação

Ainda não há verificações

Ainda não registámos nenhuma verificação para esta entrada. Assim que uma for executada, o seu histórico aparece aqui.

Como avaliamos