Gemini 3.7 Flash
Google · Sorti août 2026
Gemini 3.7 Flash est le cheval de trait Flash le plus puissant de Google à ce jour pour le codage et les agents — une véritable montée en gamme par rapport à 3.6 Flash, à la moitié du prix précédent jusqu'en 2026. Il reste toutefois derrière la frontière sur les tâches terminal et d'utilisation d'ordinateur les plus difficiles. Une mise à niveau évidente pour les créateurs d'agents sensibles aux coûts et ancrés dans l'écosystème Google ; pas un remplaçant des modèles frontières pour le code.
Est-ce fait pour vous ?
Recommandé pour
- Charges de codage et d'agents sensibles aux coûts — le tarif de lancement $0.75/$3.75 représente environ un tiers du coût mixte de Claude Sonnet 5 ou de GPT-5.6 Terra
- Ingénierie logicielle de longue haleine — DeepSWE v1.1 à 65,3 %, contre 49,0 % pour 3.6 Flash
- Développement web — Code Arena Elo 1588, en tête du tableau comparatif de Google, avec une meilleure adhésion au design system en moins de prompts
- Créateurs d'agents dans l'écosystème Google — alimente Gemini Spark ; disponible via l'API Gemini, AI Studio, Android Studio et Antigravity
Déconseillé pour
- Le codage terminal/agentique le plus difficile, où les modèles frontières mènent — GPT-5.6 Terra est devant sur DeepSWE (69,6 %), Terminal-Bench 2.1 (87,4 %) et OSWorld-2.0
- Les équipes ayant besoin de stabilité tarifaire au-delà de 2026 — le tarif de lancement expire le 31 décembre 2026, puis double pour atteindre $1.50/$7.50
Performances par tâche
Software engineering (DeepSWE v1.1)
65,3 % sur DeepSWE v1.1, un gros gain par rapport aux 49,0 % de 3.6 Flash, mais toujours derrière les 69,6 % de GPT-5.6 Terra
Production code quality (FrontierCode 1.1 Main)
43,6 % contre 34,4 % pour 3.6 Flash ; devance GPT-5.6 Terra sur le tableau de Google
Terminal/CLI agent work (Terminal-Bench 2.1)
85,8 % sur Terminal-Bench 2.1, juste derrière les 87,4 % de GPT-5.6 Terra
Web development (Code Arena)
1588 Elo sur Code Arena — meilleur score du tableau comparatif de Google
Knowledge work / long context
Contexte de 1M, 97,0 % au test d'aiguille en contexte long de 128K ; GDPval-AA à 1525 Elo, derrière les 1598 de Sonnet 5
Tarifs
Entrée
$0.75 / 1M
Sortie
$3.75 / 1M
Contexte
1M context, 64K output
Tests de performance
Aucun changement de verdict pour l’instant
L’horloge tourne dès le premier jour : les changements apparaîtront ici à mesure que notre verdict évolue.
Sources
Journal de vérification
Aucune vérification pour le moment
Nous n’avons pas encore enregistré de vérification pour cette entrée. Dès qu’une vérification s’exécute, son historique apparaît ici.