Tres Modelos Gemini Flash Lanzados — 3.5 Pro Sigue Retrasado

Google DeepMind logoGoogle DeepMindImportante22 de julio de 2026Modelos
Qué pasó
Google shipped Gemini 3.6 Flash ($1.50/$7.50 per 1M tokens with 49% DeepSWE), 3.5 Flash-Lite ($0.30/$2.50 at 350 tok/s), and Flash Cyber (government-gated cybersecurity model) — three efficiency-focused models optimized for agent workloads.
Por qué importa
Google is executing on cost and speed but cannot ship a frontier model — Gemini 3.5 Pro has missed its June release target, is reportedly months behind on coding benchmarks, and the competitive gap at the top is widening while Gemini 4 pretraining begins.
Qué hacer
Benchmark 3.6 Flash on your agent workloads — the 17% token reduction compounds at scale — and evaluate Flash-Lite for high-throughput pipelines, but build on what exists while 3.5 Pro remains unshipped.

Google DeepMind lanzó tres modelos Gemini Flash el martes — y ninguno de ellos es el modelo que todo el mundo está esperando.

Gemini 3.6 Flash ($1.50/$7.50 por 1M tokens) es el nuevo caballo de batalla: 17% menos tokens de salida que 3.5 Flash, una puntuación DeepSWE del 49% y 63.9% en MLE-Bench. Gemini 3.5 Flash-Lite ($0.30/$2.50) alcanza 350 tokens por segundo — 2x más rápido que su predecesor — y casi iguala a Gemini 3 Flash en benchmarks de programación a una fracción del costo. Gemini 3.5 Flash Cyber es un modelo especializado en ciberseguridad, disponible exclusivamente para gobiernos y socios de confianza a través de CodeMender (Google Blog, 2026).

Pero el insignia Gemini 3.5 Pro — anunciado en I/O en mayo — ha incumplido ya múltiples objetivos de lanzamiento. El líder de producto de Google, Logan Kilpatrick, dice que está "en pruebas con socios". Bloomberg informa que el modelo está meses atrasado en benchmarks de programación tras tener dificultades para cumplir los objetivos internos de rendimiento. Mientras tanto, el pre-entrenamiento de Gemini 4 ha comenzado (Google Blog, 2026; TechCrunch, 2026).

Qué pasó

Gemini 3.6 Flash es el sucesor directo de 3.5 Flash. A $1.50/M de entrada y $7.50/M de tokens de salida con una ventana de contexto de 1M de tokens, ofrece las mismas capacidades usando un 17% menos de tokens de salida — un ataque directo al problema de la inflación de tokens que encarece los costos de los agentes.

BenchmarkGemini 3.5 FlashGemini 3.6 FlashMejora
DeepSWE37%49%+12 puntos
MLE-Bench49.7%63.9%+14.2 puntos
OSWorld-Verified78.4%83.0%+4.6 puntos

Gemini 3.5 Flash-Lite alcanza 350 tokens por segundo — 2x más rápido que 3.1 Flash-Lite — logrando 54.2% en SWE-Bench Pro y 74.0% en OSWorld. A $0.30/M de entrada y $2.50/M de salida, se sitúa entre DeepSeek V4 Flash y Pro en costo de entrada (VentureBeat, 2026).

Gemini 3.5 Flash Cyber está ajustado para caza y parcheo de vulnerabilidades. Disponible exclusivamente a través de CodeMender para gobiernos y socios de confianza. Competitivo con Mythos de Anthropic en CyberGym.

Gemini 3.5 Pro (anunciado en I/O mayo 2026): repetidamente retrasado más allá de su lanzamiento prometido en junio. "En pruebas con socios, esperamos lanzarlo pronto" según Logan Kilpatrick de Google. El pre-entrenamiento de Gemini 4 ha comenzado.

Por qué importa

Google está ganando en costo y velocidad pero no puede lanzar un modelo frontier. La brecha de eficiencia entre la gama Flash de Google y sus competidores se está ampliando — 3.6 Flash a $1.50/$7.50 con 49% DeepSWE es la mejor relación precio-rendimiento que Google ha lanzado jamás. Pero la brecha Pro en la cima es estructural: retrasos repetidos, objetivos internos de rendimiento no cumplidos (según Bloomberg) y sin cronograma confirmado.

La carrera de IA pasó de puntuaciones de benchmark a eficiencia de costos. Los modelos que ganan las cargas de trabajo de agentes no son los que tienen las puntuaciones de benchmark más altas — son los que tienen el mejor rendimiento por dólar. Google lo entiende. La línea Flash está optimizada exactamente para esa métrica.

Qué cambia para ti

  • Evalúa Gemini 3.6 Flash en tus flujos de trabajo agénticos — 17% menos tokens de salida y 49% DeepSWE a $1.50/M de entrada es una mejora significativa
  • Evalúa Flash-Lite para pipelines de alto rendimiento — 350 tok/s a $0.30/M de entrada, 2x más rápido que la generación anterior
  • No planees arquitectura alrededor de Gemini 3.5 Pro — está repetidamente retrasado sin cronograma confirmado. Construye sobre lo que existe
  • Flash Cyber está disponible solo para gobiernos y socios de confianza — no es una opción comercial

FAQ

¿Es Gemini 3.6 Flash un reemplazo directo de 3.5 Flash? Sí. Misma API, misma ventana de contexto de 1M, pero 17% menos tokens de salida en las mismas tareas.

¿Cuándo se lanzará Gemini 3.5 Pro? Se desconoce. Google dice "pronto" pero ha incumplido múltiples plazos anteriores. El modelo está atrasado en benchmarks de programación.

¿Puedo probar Flash Cyber? No — está disponible exclusivamente para gobiernos y socios de confianza a través de CodeMender.

Herramientas y modelos afectados

No vuelvas a tener que ponerte al día

El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.

Al suscribirte aceptas nuestra Política de privacidad. Cancela cuando quieras.