Gemini 3.7 Flash
Google · Lanzado ago 2026
Gemini 3.7 Flash es el caballo de batalla Flash más potente de Google hasta la fecha para codificación y agentes: una mejora real frente a 3.6 Flash, a la mitad del precio anterior durante 2026. Sigue por detrás de la frontera en las tareas más difíciles de terminal y uso de computadora. Una actualización clara para quienes construyen agentes sensibles al costo y dentro del ecosistema de Google; no es un reemplazo de la codificación de frontera.
¿Es adecuada para ti?
Bueno para
- Cargas de trabajo de codificación y agentes sensibles al costo: el precio de lanzamiento de $0.75/$3.75 equivale aproximadamente a un tercio del costo combinado de Claude Sonnet 5 o GPT-5.6 Terra
- Ingeniería de software de largo alcance: 65.3% en DeepSWE v1.1, frente al 49.0% de 3.6 Flash
- Desarrollo web: 1588 Elo en Code Arena, el mejor de la tabla comparativa de Google, con mejor adherencia al sistema de diseño con menos prompts
- Quienes construyen agentes en el ecosistema de Google: potencia Gemini Spark; disponible vía Gemini API, AI Studio, Android Studio y Antigravity
No recomendado para
- La codificación terminal/agéntica más difícil, donde lideran los modelos de frontera: GPT-5.6 Terra está por delante en DeepSWE (69.6%), Terminal-Bench 2.1 (87.4%) y OSWorld-2.0
- Equipos que necesitan estabilidad de precios más allá de 2026: la tarifa de lanzamiento vence el 31 de diciembre de 2026 y luego se duplica a $1.50/$7.50
Rendimiento por tarea
Software engineering (DeepSWE v1.1)
65.3% en DeepSWE v1.1, una gran mejora frente al 49.0% de 3.6 Flash, pero aún por detrás del 69.6% de GPT-5.6 Terra
Production code quality (FrontierCode 1.1 Main)
43.6% frente al 34.4% de 3.6 Flash; supera a GPT-5.6 Terra en la tabla de Google
Terminal/CLI agent work (Terminal-Bench 2.1)
85.8% en Terminal-Bench 2.1, muy cerca del 87.4% de GPT-5.6 Terra
Web development (Code Arena)
1588 Elo en Code Arena: la mejor puntuación de la tabla comparativa de Google
Knowledge work / long context
Contexto de 1M, 97.0% en la prueba de aguja de contexto largo de 128K; 1525 Elo en GDPval-AA, por detrás de los 1598 de Sonnet 5
Precios
Entrada
$0.75 / 1M
Salida
$3.75 / 1M
Contexto
1M context, 64K output
Pruebas de rendimiento
Aún no hay cambios de veredicto
El reloj corre desde el primer día: los cambios aparecerán aquí a medida que evolucione nuestro veredicto.
Fuentes
Registro de verificación
Aún no hay comprobaciones de verificación
Todavía no hemos registrado ninguna comprobación de verificación para esta entrada. Cuando se ejecute una, su historial aparecerá aquí.