Gemini 3.1 Pro
Google · Lançado 02/2026
O modelo Pro mais capaz do Google disponível publicamente, com contexto de 1M tokens a preços competitivos. Geração anterior: Gemini 3.6 e 3.5 Flash agora o superam em benchmarks de codificação e agentes com custo menor. Mantenha-o no Google Cloud/Vertex AI; caso contrário, a linha Flash ou os concorrentes entregam mais.
É adequada para ti?
Bom para
- Raciocínio profundo em problemas científicos e matemáticos complexos
- Análise de contexto muito grande com 1M tokens
- Equipes conscientes de custo que precisam de raciocínio nível Pro a $2/$12
- Usuários do ecossistema Google Cloud/Vertex AI
Não recomendado para
- Codificação de ponta e fluxos de trabalho agentivos — modelos Flash o superam
- Implantações sensíveis à segurança — FAR.AI encontrou 249 jailbreaks universais por ~$278
Desempenho por tarefa
Complex reasoning / science
ARC-AGI-2 77.1% (2.5x Gemini 3 Pro), GPQA Diamond 94.3% — top-tier reasoning at launch
Long-context analysis
1M token context window, MRCR v2 84.9% at 128K — process entire codebases or multi-document research
Coding
SWE-Bench Verified 80.6% is strong but now trails Gemini 3.6 Flash and Claude Opus 5
Agentic workflows
APEX-Agents 33.5%, MCP Atlas 69.2% — solid but Flash models are better for production agents
Math
LiveCodeBench 2887 Elo, HLE 44.4% no-tools — strong mathematical reasoning
Multimodal understanding
MMMU-Pro 80.5% — competitive, natively multimodal across text, audio, images, video
Security / safety
FAR.AI found 249 universal jailbreaks for ~$278 — significantly weaker safeguards than Claude Fable 5 and GPT-5.6 Sol
Preços
Entrada
$2 / 1M
Saída
$12 / 1M
Contexto
1M tokens
Testes de desempenho
| Teste | Pontuação | Fonte |
|---|---|---|
| ARC-AGI-2 | 77.1% | Fonte |
| MMLU (MMMLU) | 92.6% | Fonte |
| GPQA Diamond | 94.3% | Fonte |
| SWE-Bench Verified | 80.6% | Fonte |
| SWE-Bench Pro (Public) | 54.2% | Fonte |
| Terminal-Bench 2.0 | 68.5% | Fonte |
| LiveCodeBench Pro | 2887 Elo | Fonte |
| APEX-Agents | 33.5% | Fonte |
| HLE (no tools) | 44.4% | Fonte |
| HLE (with tools) | 51.4% | Fonte |
| MCP Atlas | 69.2% | Fonte |
| BrowseComp | 85.9% | Fonte |
| MRCR v2 (128K) | 84.9% | Fonte |
| MMMU-Pro | 80.5% | Fonte |
| GDPval-AA Elo | 1317 | Fonte |
Ainda sem alterações de veredicto
O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.
Fontes
- Google DeepMind: Gemini 3.1 Pro Model Card07/2026
- FAR.AI AI Security Leaderboard07/2026
- Google AI for Developers — Official pricing page (no 3.5 Pro yet)06/2026
- Google Blog: Gemini 3.1 Pro announcement07/2026
- Metacto: Gemini API Pricing07/2026
- nxcode.io: Gemini 3.1 Pro Complete Guide07/2026
- GitHub Changelog: Gemini 3.1 Pro in Copilot07/2026
- GitHub Changelog: Gemini 2.5 Pro deprecation Jul 31, 202607/2026
Registo de verificação
- Preços— Sem alterações
Agente automatizado