Drei Gemini-Flash-Modelle ausgeliefert — 3.5 Pro weiterhin verzögert

Google DeepMind logoGoogle DeepMindWichtig22. Juli 2026Modelle
Was ist passiert
Google shipped Gemini 3.6 Flash ($1.50/$7.50 per 1M tokens with 49% DeepSWE), 3.5 Flash-Lite ($0.30/$2.50 at 350 tok/s), and Flash Cyber (government-gated cybersecurity model) — three efficiency-focused models optimized for agent workloads.
Warum es wichtig ist
Google is executing on cost and speed but cannot ship a frontier model — Gemini 3.5 Pro has missed its June release target, is reportedly months behind on coding benchmarks, and the competitive gap at the top is widening while Gemini 4 pretraining begins.
Was zu tun ist
Benchmark 3.6 Flash on your agent workloads — the 17% token reduction compounds at scale — and evaluate Flash-Lite for high-throughput pipelines, but build on what exists while 3.5 Pro remains unshipped.

Google DeepMind lieferte am Dienstag drei Gemini-Flash-Modelle aus — und keines davon ist das Modell, auf das alle gewartet haben.

Gemini 3.6 Flash ($1,50/$7,50 pro 1M Tokens) ist das neue Arbeitspferd: 17 % weniger Ausgabe-Tokens als 3.5 Flash, 49 % DeepSWE-Score und 63,9 % auf MLE-Bench. Gemini 3.5 Flash-Lite ($0,30/$2,50) erreicht 350 Tokens pro Sekunde — 2x schneller als sein Vorgänger — und kommt Gemini 3 Flash bei Coding-Benchmarks zu einem Bruchteil der Kosten nahe. Gemini 3.5 Flash Cyber ist ein auf Cybersicherheit spezialisiertes Modell, das ausschließlich Regierungen und vertrauenswürdigen Partnern über CodeMender zur Verfügung steht (Google Blog, 2026).

Doch das Flaggschiff Gemini 3.5 Pro — im Mai auf der I/O angekündigt — hat nun mehrere Veröffentlichungsziele verfehlt. Google-Produktleiter Logan Kilpatrick sagt, es werde „mit Partnern getestet". Bloomberg berichtet, das Modell liege bei Coding-Benchmarks Monate hinter dem Zeitplan, nachdem es Schwierigkeiten hatte, interne Leistungsziele zu erreichen. Unterdessen hat das Pre-Training für Gemini 4 begonnen (Google Blog, 2026; TechCrunch, 2026).

Was passiert ist

Gemini 3.6 Flash ist der direkte Nachfolger von 3.5 Flash. Mit $1,50/M Eingabe und $7,50/M Ausgabe-Tokens bei einem 1M-Token-Kontextfenster liefert es dieselben Fähigkeiten bei 17 % weniger Ausgabe-Tokens — ein direkter Angriff auf das Token-Aufblähungsproblem, das die Agentenkosten in die Höhe treibt.

BenchmarkGemini 3.5 FlashGemini 3.6 FlashVerbesserung
DeepSWE37 %49 %+12 Punkte
MLE-Bench49,7 %63,9 %+14,2 Punkte
OSWorld-Verified78,4 %83,0 %+4,6 Punkte

Gemini 3.5 Flash-Lite erreicht 350 Tokens pro Sekunde — 2x schneller als 3.1 Flash-Lite — bei 54,2 % auf SWE-Bench Pro und 74,0 % auf OSWorld. Mit $0,30/M Eingabe und $2,50/M Ausgabe liegt es preislich zwischen DeepSeek V4 Flash und Pro bei den Eingabekosten (VentureBeat, 2026).

Gemini 3.5 Flash Cyber ist für Schwachstellensuche und -behebung fine-getuned. Ausschließlich über CodeMender für Regierungen und vertrauenswürdige Partner verfügbar. Konkurrenzfähig mit Anthropics Mythos auf CyberGym.

Gemini 3.5 Pro (angekündigt I/O Mai 2026): wiederholt über den versprochenen Juni-Launch hinaus verzögert. „Test mit Partnern, hoffentlich bald" laut Googles Logan Kilpatrick. Das Pre-Training für Gemini 4 hat begonnen.

Warum es wichtig ist

Google gewinnt bei Kosten und Geschwindigkeit, kann aber kein Frontier-Modell ausliefern. Die Effizienzlücke zwischen Googles Flash-Stufe und seinen Wettbewerbern wird größer — 3.6 Flash zu $1,50/$7,50 mit 49 % DeepSWE ist das beste Preis-Leistungs-Verhältnis, das Google je ausgeliefert hat. Aber die Pro-Lücke an der Spitze ist strukturell: wiederholte Verzögerungen, verfehlte interne Leistungsziele (laut Bloomberg) und kein bestätigter Zeitplan.

Das KI-Rennen hat sich von Benchmark-Scores zu Kosteneffizienz verschoben. Die Modelle, die Agenten-Workloads gewinnen, sind nicht die mit den höchsten Benchmark-Scores — es sind die mit der besten Leistung pro Dollar. Google versteht das. Die Flash-Reihe ist genau auf diese Metrik optimiert.

Was sich für Sie ändert

  • Benchmarken Sie Gemini 3.6 Flash auf Ihren Agenten-Workflows — 17 % weniger Ausgabe-Tokens und 49 % DeepSWE zu $1,50/M Eingabe ist eine bedeutende Verbesserung
  • Evaluieren Sie Flash-Lite für Hochdurchsatz-Pipelines — 350 Tok/s zu $0,30/M Eingabe, 2x schneller als die Vorgängergeneration
  • Planen Sie keine Architektur um Gemini 3.5 Pro — es ist wiederholt verzögert ohne bestätigten Zeitplan. Bauen Sie für das, was existiert
  • Flash Cyber ist nur für Regierungen und vertrauenswürdige Partner verfügbar — keine kommerzielle Option

FAQ

Ist Gemini 3.6 Flash ein Drop-in-Ersatz für 3.5 Flash? Ja. Gleiche API, gleiches 1M-Kontextfenster, aber 17 % weniger Ausgabe-Tokens bei denselben Aufgaben.

Wann wird Gemini 3.5 Pro ausgeliefert? Unbekannt. Google sagt „bald", hat aber mehrere frühere Fristen verfehlt. Das Modell liegt bei Coding-Benchmarks zurück.

Kann ich Flash Cyber testen? Nein — es ist ausschließlich für Regierungen und vertrauenswürdige Partner über CodeMender verfügbar.

Betroffene Tools & Modelle

Nie wieder etwas verpassen

Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.

Mit dem Abonnieren stimmst du unserer Datenschutzerklärung zu. Jederzeit abbestellbar.