Gemini 3.5 Pro GA iminente: 2M tokens, Deep Think

Google logoGoogleVeredicto alterado23 de junho de 2026Modelos
O que aconteceu
Gemini 3.5 Pro GA is expected June 23–30 with a 2M-token context window and Deep Think reasoning.
Porque é importante
Google is timing this against GPT-5.6 and Fable 5's paywall in the busiest frontier-model release week of 2026.
O que fazer
Google Cloud teams should wait for GA. Everyone else, hold until early July when all three models are live and benchmarked.

Veredito: O Google está sincronizando o GA do Gemini 3.5 Pro diretamente contra o GPT-5.6 e a transição de paywall do Claude Fable 5. Junho de 2026 é o mês mais importante da história de lançamentos de modelos de ponta — três modelos chegando com 10 dias de diferença entre si, e o Google tem uma janela.

O que aconteceu

Segundo análise do andrew.ooo (andrew.ooo, 2026(abre num novo separador)), o cronograma do final de junho se desenha assim:

EventoDataStatus
Lançamento do Claude Fable 59 jun 2026Lançado
Paywall do Fable 522 jun 2026Iminente
Gemini 3.5 Pro GA23–30 jun 2026Esperado
Lançamento do GPT-5.6Final de junho / início de julhoEsperado

Esse agrupamento não é acidental. Cada provedor está se posicionando para máxima atenção. O Fable 5, que cobrimos no lançamento, entrou no paywall em 22 de junho. A janela do Gemini 3.5 Pro rouba a atenção dessa transição. O GPT-5.6 pega carona no ciclo de imprensa pós-paywall e chega antes da desaceleração do verão americano.

O que o Gemini 3.5 Pro traz

  • Janela de contexto de 2M tokens — líder estrutural, 2× os 1M do Fable 5 e bem à frente da faixa esperada de 200K–1M do GPT-5.6
  • Modo de raciocínio Deep Think — a resposta do Google ao Claude Extended Thinking e à série o da OpenAI
  • Multimodal nativo — suporte a imagem, vídeo e áudio que nem Anthropic nem OpenAI igualam atualmente em qualidade de ponta
  • Preço esperado: $4–6 / $20–30 por 1M tokens — o Google tradicionalmente compete em preço, tornando o Gemini 3.5 Pro a opção de ponta com melhor custo-benefício

Por que isso importa

No SWE-bench Pro: Fable 5 lidera com ~69.2%, com Gemini 3.5 Pro em ~65–67% em benchmarks de preview. Espera-se que o GPT-5.6 iguale ou supere marginalmente o Fable 5. Para tarefas de programação do dia a dia que cabem em 200K de contexto, essas diferenças são marginais.

Para cargas de trabalho que genuinamente precisam de 1M+ de contexto — refatorações de monorepo inteiro, análise de múltiplos documentos, execuções de agentes de longa duração — o Gemini 3.5 Pro é o vencedor estrutural. A janela de contexto de 2M não é um bump menor de especificação; é uma categoria de capacidade em que nenhum outro modelo de ponta compete.

O encaixe no ecossistema importa mais do que benchmarks brutos. Usuários do Google Workspace ganham integração nativa com custo zero de migração. Usuários da Anthropic ficam com Claude Code e servidores MCP. Usuários da OpenAI ficam com ChatGPT e Codex. Para a maioria das equipes, a jogada certa é fazer upgrade dentro do seu provedor atual — não trocar.

O que muda para você

Se você está no Google Cloud ou Workspace: Espere o GA do Gemini 3.5 Pro. A janela de contexto de 2M mais o preço historicamente agressivo do Google o tornam o padrão racional para equipes do ecossistema Google.

Se sua decisão pode esperar: Segure até a primeira semana de julho, quando todos os três modelos estiverem ao vivo e benchmarks de terceiros estiverem disponíveis. O Claude Fable 5 é a escolha mais segura agora — capacidade conhecida, preço conhecido.

Para usuários do Gemini 2.5 Pro: Atualmente classificamos o Gemini 2.5 Pro como Recommended — a escolha de contexto longo com bom custo. Reavaliaremos este veredito quando o 3.5 Pro estiver ao vivo e benchmarkado. Se o 3.5 Pro entregar capacidade competitiva com perfil de custo similar, a recomendação do 2.5 Pro pode se estreitar.

FAQ

Quando exatamente o Gemini 3.5 Pro chega ao GA? A janela esperada é 23–30 de junho de 2026. O Google não anunciou uma data específica, mas o timing é informado pelo calendário competitivo — a transição do paywall do Fable 5 em 22 de junho e o esperado lançamento do GPT-5.6 no final de junho.

O contexto de 2M é realmente utilizável? Sim — diferentemente de alguns modelos que anunciam contexto alto mas degradam em qualidade perto do limite, a arquitetura Gemini do Google historicamente entrega forte recall em toda a sua janela de contexto. O número de 2M representa contexto utilizável, não apenas capacidade teórica.

Devo trocar de provedor por causa disso? Provavelmente não. A menos que sua carga de trabalho genuinamente exija 2M de contexto — e a maioria não exige — o custo de troca (ecossistema, ferramental, retreinamento) supera a diferença marginal de benchmark entre modelos de ponta. Faça upgrade dentro do seu provedor; não migre.

Ferramentas e modelos afetados

Gemini 3.5 ProGemini 2.5 Pro

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.