Três Modelos Gemini Flash Chegam — 3.5 Pro Ainda Atrasado

Google DeepMind logoGoogle DeepMindImportante22 de julho de 2026Modelos
O que aconteceu
Google shipped Gemini 3.6 Flash ($1.50/$7.50 per 1M tokens with 49% DeepSWE), 3.5 Flash-Lite ($0.30/$2.50 at 350 tok/s), and Flash Cyber (government-gated cybersecurity model) — three efficiency-focused models optimized for agent workloads.
Porque é importante
Google is executing on cost and speed but cannot ship a frontier model — Gemini 3.5 Pro has missed its June release target, is reportedly months behind on coding benchmarks, and the competitive gap at the top is widening while Gemini 4 pretraining begins.
O que fazer
Benchmark 3.6 Flash on your agent workloads — the 17% token reduction compounds at scale — and evaluate Flash-Lite for high-throughput pipelines, but build on what exists while 3.5 Pro remains unshipped.

O Google DeepMind lançou três modelos Gemini Flash na terça-feira — e nenhum deles é o modelo que todos estão esperando.

O Gemini 3.6 Flash ($1,50/$7,50 por 1M de tokens) é o novo cavalo de batalha: 17% menos tokens de saída que o 3.5 Flash, pontuação DeepSWE de 49% e 63,9% no MLE-Bench. O Gemini 3.5 Flash-Lite ($0,30/$2,50) atinge 350 tokens por segundo — 2x mais rápido que seu antecessor — e quase iguala o Gemini 3 Flash em benchmarks de codificação por uma fração do custo. O Gemini 3.5 Flash Cyber é um modelo especializado em cibersegurança, disponível exclusivamente para governos e parceiros confiáveis via CodeMender (Google Blog, 2026).

Mas o principal Gemini 3.5 Pro — anunciado no I/O em maio — já perdeu várias metas de lançamento. O líder de produto do Google, Logan Kilpatrick, diz que está "em testes com parceiros". A Bloomberg relata que o modelo está meses atrasado em benchmarks de codificação após dificuldades para atingir metas internas de desempenho. Enquanto isso, o pré-treinamento do Gemini 4 começou (Google Blog, 2026; TechCrunch, 2026).

O que aconteceu

Gemini 3.6 Flash é o sucessor direto do 3.5 Flash. A $1,50/M de entrada e $7,50/M de tokens de saída com janela de contexto de 1M de tokens, ele entrega as mesmas capacidades usando 17% menos tokens de saída — um ataque direto ao problema de inchaço de tokens que infla os custos de agentes.

BenchmarkGemini 3.5 FlashGemini 3.6 FlashMelhoria
DeepSWE37%49%+12 pontos
MLE-Bench49,7%63,9%+14,2 pontos
OSWorld-Verified78,4%83,0%+4,6 pontos

Gemini 3.5 Flash-Lite atinge 350 tokens por segundo — 2x mais rápido que o 3.1 Flash-Lite — enquanto marca 54,2% no SWE-Bench Pro e 74,0% no OSWorld. A $0,30/M de entrada e $2,50/M de saída, está posicionado entre DeepSeek V4 Flash e Pro em custo de entrada (VentureBeat, 2026).

Gemini 3.5 Flash Cyber é ajustado para caça e correção de vulnerabilidades. Disponível exclusivamente via CodeMender para governos e parceiros confiáveis. Competitivo com o Mythos da Anthropic no CyberGym.

Gemini 3.5 Pro (anunciado no I/O de maio de 2026): repetidamente adiado após o prometido lançamento em junho. "Em testes com parceiros, esperamos disponibilizar em breve" segundo Logan Kilpatrick do Google. O pré-treinamento do Gemini 4 já começou.

Por que isso importa

O Google está vencendo em custo e velocidade, mas não consegue lançar um modelo de fronteira. A lacuna de eficiência entre a linha Flash do Google e seus concorrentes está aumentando — 3.6 Flash a $1,50/$7,50 com 49% no DeepSWE é a melhor relação preço-desempenho que o Google já lançou. Mas a lacuna Pro no topo é estrutural: atrasos repetidos, metas internas de desempenho não atingidas (segundo a Bloomberg) e nenhum cronograma confirmado.

A corrida da IA mudou de pontuações de benchmark para eficiência de custo. Os modelos que vencem em cargas de agentes não são os com as maiores pontuações de benchmark — são os com o melhor desempenho por dólar. O Google entende isso. A linha Flash é otimizada exatamente para essa métrica.

O que muda para você

  • Faça benchmark do Gemini 3.6 Flash nos seus fluxos de agentes — 17% menos tokens de saída e 49% no DeepSWE a $1,50/M de entrada é uma melhoria significativa
  • Avalie o Flash-Lite para pipelines de alta vazão — 350 tok/s a $0,30/M de entrada, 2x mais rápido que a geração anterior
  • Não planeje arquitetura em torno do Gemini 3.5 Pro — ele está repetidamente atrasado sem cronograma confirmado. Construa sobre o que existe
  • Flash Cyber está disponível apenas para governos e parceiros confiáveis — não é uma opção comercial

FAQ

O Gemini 3.6 Flash é um substituto direto para o 3.5 Flash? Sim. Mesma API, mesma janela de contexto de 1M, mas 17% menos tokens de saída nas mesmas tarefas.

Quando o Gemini 3.5 Pro será lançado? Desconhecido. O Google diz "em breve", mas já perdeu vários prazos anteriores. O modelo está atrasado em benchmarks de codificação.

Posso testar o Flash Cyber? Não — está disponível exclusivamente para governos e parceiros confiáveis via CodeMender.

Ferramentas e modelos afetados

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.