Gemini 3.5 Pro GA steht bevor: 2M Tokens, Deep Think
- Was ist passiert
- Gemini 3.5 Pro GA is expected June 23–30 with a 2M-token context window and Deep Think reasoning.
- Warum es wichtig ist
- Google is timing this against GPT-5.6 and Fable 5's paywall in the busiest frontier-model release week of 2026.
- Was zu tun ist
- Google Cloud teams should wait for GA. Everyone else, hold until early July when all three models are live and benchmarked.
Urteil: Google platziert Gemini 3.5 Pro GA direkt gegen GPT-5.6 und Claude Fable 5s Paywall-Übergang. Juni 2026 ist der wichtigste Monat in der Geschichte der Frontier-Modell-Veröffentlichungen — drei Modelle landen innerhalb von 10 Tagen, und Google hat ein Zeitfenster.
Was passiert ist
Laut Analyse von andrew.ooo (andrew.ooo, 2026(wird in einem neuen Tab geöffnet)) stellt sich der Zeitplan für Ende Juni wie folgt dar:
| Ereignis | Datum | Status |
|---|---|---|
| Claude Fable 5 Launch | 9. Juni 2026 | Veröffentlicht |
| Fable 5 Paywall | 22. Juni 2026 | Steht bevor |
| Gemini 3.5 Pro GA | 23.–30. Juni 2026 | Erwartet |
| GPT-5.6 Launch | Ende Juni / Anfang Juli | Erwartet |
Diese Bündelung ist kein Zufall. Jeder Anbieter positioniert sich für maximale Aufmerksamkeit. Fable 5, über das wir zum Launch berichteten, ging am 22. Juni hinter eine Paywall. Gemini 3.5 Pros Zeitfenster zieht Aufmerksamkeit von diesem Übergang ab. GPT-5.6 reitet auf dem Post-Paywall-Pressezyklus und landet vor der US-Sommerflauten.
Was Gemini 3.5 Pro bringt
- 2M-Token-Kontextfenster — der strukturelle Spitzenreiter, 2× Fable 5s 1M und deutlich vor GPT-5.6s erwarteten 200K–1M
- Deep Think Reasoning-Modus — Googles Antwort auf Claude Extended Thinking und OpenAIs o-Serie
- Nativ multimodal — Bild-, Video-, Audio-Unterstützung, die weder Anthropic noch OpenAI derzeit in Frontier-Qualität erreichen
- Erwartete Preise: 4–6 $ / 20–30 $ pro 1M Tokens — Google unterbietet traditionell beim Preis, was Gemini 3.5 Pro zur kostengünstigsten Frontier-Option macht
Warum es wichtig ist
Im SWE-bench Pro: Fable 5 führt mit ~69,2 %, Gemini 3.5 Pro bei ~65–67 % in Preview-Benchmarks. GPT-5.6 wird erwartet, Fable 5 zu erreichen oder marginal zu übertreffen. Für alltägliche Coding-Aufgaben, die in 200K Kontext passen, sind diese Unterschiede marginal.
Für Workloads, die wirklich 1M+ Kontext benötigen — ganze Monorepo-Refactorings, Multi-Dokument-Analyse, Langhorizont-Agent-Läufe — ist Gemini 3.5 Pro der strukturelle Gewinner. Das 2M-Kontextfenster ist kein geringfügiger Spezifikationssprung; es ist eine Fähigkeitskategorie, in der kein anderes Frontier-Modell mithalten kann.
Die Ökosystem-Passung zählt mehr als rohe Benchmarks. Google Workspace-Nutzer erhalten native Integration zu null Migrationskosten. Anthropic-Nutzer bleiben bei Claude Code und MCP-Servern. OpenAI-Nutzer bleiben bei ChatGPT und Codex. Für die meisten Teams ist der richtige Schritt, innerhalb des aktuellen Anbieters ein Upgrade durchzuführen — nicht zu wechseln.
Was sich für dich ändert
Wenn du auf Google Cloud oder Workspace bist: Warte auf Gemini 3.5 Pro GA. Das 2M-Kontextfenster plus Googles historisch aggressive Preisgestaltung machen es zur rationalen Standardwahl für Google-Ökosystem-Teams.
Wenn deine Entscheidung warten kann: Halte bis zur ersten Juli-Woche, wenn alle drei Modelle live sind und unabhängige Benchmarks vorliegen. Claude Fable 5 ist derzeit die sicherste Wahl — bekannte Fähigkeit, bekannte Preise.
Für Gemini 2.5 Pro-Nutzer: Wir bewerten Gemini 2.5 Pro derzeit als Recommended — die budgetfreundliche Langkontext-Wahl. Wir werden dieses Urteil neu bewerten, sobald 3.5 Pro live und benchmarkt ist. Wenn 3.5 Pro wettbewerbsfähige Fähigkeiten zu einem ähnlichen Kostenprofil liefert, könnte sich die 2.5 Pro-Empfehlung verengen.
FAQ
Wann genau geht Gemini 3.5 Pro in GA? Das erwartete Zeitfenster ist 23.–30. Juni 2026. Google hat kein spezifisches Datum angekündigt, aber das Timing ergibt sich aus dem Wettbewerbskalender — Fable 5s Paywall-Übergang am 22. Juni und GPT-5.6s erwarteter Launch Ende Juni.
Ist 2M Kontext tatsächlich nutzbar? Ja — anders als einige Modelle, die hohen Kontext bewerben, aber in der Qualität zum Limit hin abfallen, hat Googles Gemini-Architektur historisch starken Recall über das gesamte Kontextfenster hinweg geliefert. Die 2M-Zahl repräsentiert nutzbaren Kontext, nicht nur theoretische Kapazität.
Sollte ich dafür den Anbieter wechseln? Wahrscheinlich nicht. Es sei denn, dein Workload erfordert wirklich 2M Kontext — und die meisten tun das nicht — überwiegen die Wechselkosten (Ökosystem, Tooling, Umschulung) den marginalen Benchmark-Unterschied zwischen Frontier-Modellen. Upgrade innerhalb deines Anbieters; migriere nicht.
Betroffene Tools & Modelle
Nie wieder etwas verpassen
Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.