Três Modelos Gemini Flash Chegam — 3.5 Pro Ainda Atrasado
- O que aconteceu
- Google shipped Gemini 3.6 Flash ($1.50/$7.50 per 1M tokens with 49% DeepSWE), 3.5 Flash-Lite ($0.30/$2.50 at 350 tok/s), and Flash Cyber (government-gated cybersecurity model) — three efficiency-focused models optimized for agent workloads.
- Porque é importante
- Google is executing on cost and speed but cannot ship a frontier model — Gemini 3.5 Pro has missed its June release target, is reportedly months behind on coding benchmarks, and the competitive gap at the top is widening while Gemini 4 pretraining begins.
- O que fazer
- Benchmark 3.6 Flash on your agent workloads — the 17% token reduction compounds at scale — and evaluate Flash-Lite for high-throughput pipelines, but build on what exists while 3.5 Pro remains unshipped.
O Google DeepMind lançou três modelos Gemini Flash na terça-feira — e nenhum deles é o modelo que todos estão esperando.
O Gemini 3.6 Flash ($1,50/$7,50 por 1M de tokens) é o novo cavalo de batalha: 17% menos tokens de saída que o 3.5 Flash, pontuação DeepSWE de 49% e 63,9% no MLE-Bench. O Gemini 3.5 Flash-Lite ($0,30/$2,50) atinge 350 tokens por segundo — 2x mais rápido que seu antecessor — e quase iguala o Gemini 3 Flash em benchmarks de codificação por uma fração do custo. O Gemini 3.5 Flash Cyber é um modelo especializado em cibersegurança, disponível exclusivamente para governos e parceiros confiáveis via CodeMender (Google Blog, 2026).
Mas o principal Gemini 3.5 Pro — anunciado no I/O em maio — já perdeu várias metas de lançamento. O líder de produto do Google, Logan Kilpatrick, diz que está "em testes com parceiros". A Bloomberg relata que o modelo está meses atrasado em benchmarks de codificação após dificuldades para atingir metas internas de desempenho. Enquanto isso, o pré-treinamento do Gemini 4 começou (Google Blog, 2026; TechCrunch, 2026).
O que aconteceu
Gemini 3.6 Flash é o sucessor direto do 3.5 Flash. A $1,50/M de entrada e $7,50/M de tokens de saída com janela de contexto de 1M de tokens, ele entrega as mesmas capacidades usando 17% menos tokens de saída — um ataque direto ao problema de inchaço de tokens que infla os custos de agentes.
| Benchmark | Gemini 3.5 Flash | Gemini 3.6 Flash | Melhoria |
|---|---|---|---|
| DeepSWE | 37% | 49% | +12 pontos |
| MLE-Bench | 49,7% | 63,9% | +14,2 pontos |
| OSWorld-Verified | 78,4% | 83,0% | +4,6 pontos |
Gemini 3.5 Flash-Lite atinge 350 tokens por segundo — 2x mais rápido que o 3.1 Flash-Lite — enquanto marca 54,2% no SWE-Bench Pro e 74,0% no OSWorld. A $0,30/M de entrada e $2,50/M de saída, está posicionado entre DeepSeek V4 Flash e Pro em custo de entrada (VentureBeat, 2026).
Gemini 3.5 Flash Cyber é ajustado para caça e correção de vulnerabilidades. Disponível exclusivamente via CodeMender para governos e parceiros confiáveis. Competitivo com o Mythos da Anthropic no CyberGym.
Gemini 3.5 Pro (anunciado no I/O de maio de 2026): repetidamente adiado após o prometido lançamento em junho. "Em testes com parceiros, esperamos disponibilizar em breve" segundo Logan Kilpatrick do Google. O pré-treinamento do Gemini 4 já começou.
Por que isso importa
O Google está vencendo em custo e velocidade, mas não consegue lançar um modelo de fronteira. A lacuna de eficiência entre a linha Flash do Google e seus concorrentes está aumentando — 3.6 Flash a $1,50/$7,50 com 49% no DeepSWE é a melhor relação preço-desempenho que o Google já lançou. Mas a lacuna Pro no topo é estrutural: atrasos repetidos, metas internas de desempenho não atingidas (segundo a Bloomberg) e nenhum cronograma confirmado.
A corrida da IA mudou de pontuações de benchmark para eficiência de custo. Os modelos que vencem em cargas de agentes não são os com as maiores pontuações de benchmark — são os com o melhor desempenho por dólar. O Google entende isso. A linha Flash é otimizada exatamente para essa métrica.
O que muda para você
- Faça benchmark do Gemini 3.6 Flash nos seus fluxos de agentes — 17% menos tokens de saída e 49% no DeepSWE a $1,50/M de entrada é uma melhoria significativa
- Avalie o Flash-Lite para pipelines de alta vazão — 350 tok/s a $0,30/M de entrada, 2x mais rápido que a geração anterior
- Não planeje arquitetura em torno do Gemini 3.5 Pro — ele está repetidamente atrasado sem cronograma confirmado. Construa sobre o que existe
- Flash Cyber está disponível apenas para governos e parceiros confiáveis — não é uma opção comercial
FAQ
O Gemini 3.6 Flash é um substituto direto para o 3.5 Flash? Sim. Mesma API, mesma janela de contexto de 1M, mas 17% menos tokens de saída nas mesmas tarefas.
Quando o Gemini 3.5 Pro será lançado? Desconhecido. O Google diz "em breve", mas já perdeu vários prazos anteriores. O modelo está atrasado em benchmarks de codificação.
Posso testar o Flash Cyber? Não — está disponível exclusivamente para governos e parceiros confiáveis via CodeMender.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.