Gemini 3.7 Flash logo

Gemini 3.7 Flash

Google · Lanzado ago 2026

Recomendado

Gemini 3.7 Flash es el caballo de batalla Flash más potente de Google hasta la fecha para codificación y agentes: una mejora real frente a 3.6 Flash, a la mitad del precio anterior durante 2026. Sigue por detrás de la frontera en las tareas más difíciles de terminal y uso de computadora. Una actualización clara para quienes construyen agentes sensibles al costo y dentro del ecosistema de Google; no es un reemplazo de la codificación de frontera.

¿Es adecuada para ti?

Bueno para

  • Cargas de trabajo de codificación y agentes sensibles al costo: el precio de lanzamiento de $0.75/$3.75 equivale aproximadamente a un tercio del costo combinado de Claude Sonnet 5 o GPT-5.6 Terra
  • Ingeniería de software de largo alcance: 65.3% en DeepSWE v1.1, frente al 49.0% de 3.6 Flash
  • Desarrollo web: 1588 Elo en Code Arena, el mejor de la tabla comparativa de Google, con mejor adherencia al sistema de diseño con menos prompts
  • Quienes construyen agentes en el ecosistema de Google: potencia Gemini Spark; disponible vía Gemini API, AI Studio, Android Studio y Antigravity

No recomendado para

  • La codificación terminal/agéntica más difícil, donde lideran los modelos de frontera: GPT-5.6 Terra está por delante en DeepSWE (69.6%), Terminal-Bench 2.1 (87.4%) y OSWorld-2.0
  • Equipos que necesitan estabilidad de precios más allá de 2026: la tarifa de lanzamiento vence el 31 de diciembre de 2026 y luego se duplica a $1.50/$7.50

Rendimiento por tarea

Software engineering (DeepSWE v1.1)

Very Good

65.3% en DeepSWE v1.1, una gran mejora frente al 49.0% de 3.6 Flash, pero aún por detrás del 69.6% de GPT-5.6 Terra

Production code quality (FrontierCode 1.1 Main)

Very Good

43.6% frente al 34.4% de 3.6 Flash; supera a GPT-5.6 Terra en la tabla de Google

Terminal/CLI agent work (Terminal-Bench 2.1)

Very Good

85.8% en Terminal-Bench 2.1, muy cerca del 87.4% de GPT-5.6 Terra

Web development (Code Arena)

Excellent

1588 Elo en Code Arena: la mejor puntuación de la tabla comparativa de Google

Knowledge work / long context

Very Good

Contexto de 1M, 97.0% en la prueba de aguja de contexto largo de 128K; 1525 Elo en GDPval-AA, por detrás de los 1598 de Sonnet 5

Precios

Entrada

$0.75 / 1M

Salida

$3.75 / 1M

Contexto

1M context, 64K output

Ver precios completos

Pruebas de rendimiento

PruebaPuntuaciónFuente
DeepSWE v1.165.3% Fuente
FrontierCode 1.1 Main43.6% Fuente
Terminal-Bench 2.185.8% Fuente
Code Arena (Web Dev) Elo1588 Fuente
Artificial Analysis Intelligence Index56 Fuente

Aún no hay cambios de veredicto

El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.

Registro de verificación

Aún no hay comprobaciones de verificación

Todavía no hemos registrado ninguna comprobación de verificación para esta entrada. Cuando se ejecute una, su historial aparecerá aquí.

Cómo evaluamos