Gemini 3.7 Flash
Google · Lançado 08/2026
O Gemini 3.7 Flash é o cavalo de batalha Flash mais forte do Google até agora para código e agentes — um avanço genuíno em relação ao 3.6 Flash pela metade do preço anterior até 2026. Ele ainda fica atrás da fronteira nas tarefas mais difíceis de terminal e uso de computador. Um upgrade claro para construtores de agentes sensíveis a custo e do ecossistema Google; não é um substituto de código de fronteira.
É adequada para ti?
Bom para
- Cargas de trabalho de código e agentes sensíveis a custo — o preço de lançamento de $0.75/$3.75 é cerca de um terço do custo combinado do Claude Sonnet 5 ou do GPT-5.6 Terra
- Engenharia de software de longo horizonte — DeepSWE v1.1 65,3%, acima dos 49,0% do 3.6 Flash
- Desenvolvimento web — Code Arena Elo 1588, topo da tabela comparativa do Google, com melhor aderência ao design system em menos prompts
- Construtores de agentes do ecossistema Google — alimenta o Gemini Spark; disponível via Gemini API, AI Studio, Android Studio e Antigravity
Não recomendado para
- Código agêntico/de terminal mais difícil onde os modelos de fronteira lideram — o GPT-5.6 Terra está à frente no DeepSWE (69,6%), no Terminal-Bench 2.1 (87,4%) e no OSWorld-2.0
- Times que precisam de estabilidade de preço além de 2026 — a taxa de lançamento expira em 31 de dez de 2026, depois dobra para $1.50/$7.50
Desempenho por tarefa
Software engineering (DeepSWE v1.1)
65,3% no DeepSWE v1.1, um grande ganho sobre os 49,0% do 3.6 Flash, mas ainda atrás dos 69,6% do GPT-5.6 Terra
Production code quality (FrontierCode 1.1 Main)
43,6% vs 34,4% do 3.6 Flash; lidera sobre o GPT-5.6 Terra na tabela do Google
Terminal/CLI agent work (Terminal-Bench 2.1)
85,8% no Terminal-Bench 2.1, logo atrás dos 87,4% do GPT-5.6 Terra
Web development (Code Arena)
1588 Elo no Code Arena — maior pontuação na tabela comparativa do Google
Knowledge work / long context
Contexto de 1M, 97,0% no teste de agulha de contexto longo de 128K; GDPval-AA 1525 Elo fica atrás dos 1598 do Sonnet 5
Preços
Entrada
$0.75 / 1M
Saída
$3.75 / 1M
Contexto
1M context, 64K output
Testes de desempenho
Ainda sem alterações de veredicto
O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.
Fontes
Registo de verificação
Ainda não há verificações
Ainda não registámos nenhuma verificação para esta entrada. Assim que uma for executada, o seu histórico aparece aqui.