Gemini 3.7 Flash logo

Gemini 3.7 Flash

Google · Sorti août 2026

Recommandé

Gemini 3.7 Flash est le cheval de trait Flash le plus puissant de Google à ce jour pour le codage et les agents — une véritable montée en gamme par rapport à 3.6 Flash, à la moitié du prix précédent jusqu'en 2026. Il reste toutefois derrière la frontière sur les tâches terminal et d'utilisation d'ordinateur les plus difficiles. Une mise à niveau évidente pour les créateurs d'agents sensibles aux coûts et ancrés dans l'écosystème Google ; pas un remplaçant des modèles frontières pour le code.

Est-ce fait pour vous ?

Recommandé pour

  • Charges de codage et d'agents sensibles aux coûts — le tarif de lancement $0.75/$3.75 représente environ un tiers du coût mixte de Claude Sonnet 5 ou de GPT-5.6 Terra
  • Ingénierie logicielle de longue haleine — DeepSWE v1.1 à 65,3 %, contre 49,0 % pour 3.6 Flash
  • Développement web — Code Arena Elo 1588, en tête du tableau comparatif de Google, avec une meilleure adhésion au design system en moins de prompts
  • Créateurs d'agents dans l'écosystème Google — alimente Gemini Spark ; disponible via l'API Gemini, AI Studio, Android Studio et Antigravity

Déconseillé pour

  • Le codage terminal/agentique le plus difficile, où les modèles frontières mènent — GPT-5.6 Terra est devant sur DeepSWE (69,6 %), Terminal-Bench 2.1 (87,4 %) et OSWorld-2.0
  • Les équipes ayant besoin de stabilité tarifaire au-delà de 2026 — le tarif de lancement expire le 31 décembre 2026, puis double pour atteindre $1.50/$7.50

Performances par tâche

Software engineering (DeepSWE v1.1)

Very Good

65,3 % sur DeepSWE v1.1, un gros gain par rapport aux 49,0 % de 3.6 Flash, mais toujours derrière les 69,6 % de GPT-5.6 Terra

Production code quality (FrontierCode 1.1 Main)

Very Good

43,6 % contre 34,4 % pour 3.6 Flash ; devance GPT-5.6 Terra sur le tableau de Google

Terminal/CLI agent work (Terminal-Bench 2.1)

Very Good

85,8 % sur Terminal-Bench 2.1, juste derrière les 87,4 % de GPT-5.6 Terra

Web development (Code Arena)

Excellent

1588 Elo sur Code Arena — meilleur score du tableau comparatif de Google

Knowledge work / long context

Very Good

Contexte de 1M, 97,0 % au test d'aiguille en contexte long de 128K ; GDPval-AA à 1525 Elo, derrière les 1598 de Sonnet 5

Tarifs

Entrée

$0.75 / 1M

Sortie

$3.75 / 1M

Contexte

1M context, 64K output

Voir tous les tarifs

Tests de performance

TestScoreSource
DeepSWE v1.165.3% Source
FrontierCode 1.1 Main43.6% Source
Terminal-Bench 2.185.8% Source
Code Arena (Web Dev) Elo1588 Source
Artificial Analysis Intelligence Index56 Source

Aucun changement de verdict pour l’instant

L’horloge tourne dès le premier jour : les changements apparaîtront ici à mesure que notre verdict évolue.

Journal de vérification

Aucune vérification pour le moment

Nous n’avons pas encore enregistré de vérification pour cette entrée. Dès qu’une vérification s’exécute, son historique apparaît ici.

Comment nous évaluons