Gemini 3.1 Pro logo

Gemini 3.1 Pro

Google · Lançado 02/2026

Condicional

O modelo Pro mais capaz do Google disponível publicamente, com contexto de 1M tokens a preços competitivos. Geração anterior: Gemini 3.6 e 3.5 Flash agora o superam em benchmarks de codificação e agentes com custo menor. Mantenha-o no Google Cloud/Vertex AI; caso contrário, a linha Flash ou os concorrentes entregam mais.

É adequada para ti?

Bom para

  • Raciocínio profundo em problemas científicos e matemáticos complexos
  • Análise de contexto muito grande com 1M tokens
  • Equipes conscientes de custo que precisam de raciocínio nível Pro a $2/$12
  • Usuários do ecossistema Google Cloud/Vertex AI

Não recomendado para

  • Codificação de ponta e fluxos de trabalho agentivos — modelos Flash o superam
  • Implantações sensíveis à segurança — FAR.AI encontrou 249 jailbreaks universais por ~$278

Desempenho por tarefa

Complex reasoning / science

Excellent

ARC-AGI-2 77.1% (2.5x Gemini 3 Pro), GPQA Diamond 94.3% — top-tier reasoning at launch

Long-context analysis

Excellent

1M token context window, MRCR v2 84.9% at 128K — process entire codebases or multi-document research

Coding

Very Good

SWE-Bench Verified 80.6% is strong but now trails Gemini 3.6 Flash and Claude Opus 5

Agentic workflows

Very Good

APEX-Agents 33.5%, MCP Atlas 69.2% — solid but Flash models are better for production agents

Math

Excellent

LiveCodeBench 2887 Elo, HLE 44.4% no-tools — strong mathematical reasoning

Multimodal understanding

Very Good

MMMU-Pro 80.5% — competitive, natively multimodal across text, audio, images, video

Security / safety

Fair

FAR.AI found 249 universal jailbreaks for ~$278 — significantly weaker safeguards than Claude Fable 5 and GPT-5.6 Sol

Preços

Entrada

$2 / 1M

Saída

$12 / 1M

Contexto

1M tokens

Ver preços completos

Testes de desempenho

TestePontuaçãoFonte
ARC-AGI-277.1% Fonte
MMLU (MMMLU)92.6% Fonte
GPQA Diamond94.3% Fonte
SWE-Bench Verified80.6% Fonte
SWE-Bench Pro (Public)54.2% Fonte
Terminal-Bench 2.068.5% Fonte
LiveCodeBench Pro2887 Elo Fonte
APEX-Agents33.5% Fonte
HLE (no tools)44.4% Fonte
HLE (with tools)51.4% Fonte
MCP Atlas69.2% Fonte
BrowseComp85.9% Fonte
MRCR v2 (128K)84.9% Fonte
MMMU-Pro80.5% Fonte
GDPval-AA Elo1317 Fonte

Ainda sem alterações de veredicto

O relógio começa a contar no primeiro dia: as alterações aparecem aqui à medida que o nosso veredicto evolui.

Registo de verificação

  • Preços— Sem alterações

    Agente automatizado

Como avaliamos