Gemini 3.5 Pro GA steht bevor: 2M Tokens, Deep Think

Google logoGoogleUrteil geändert23. Juni 2026Modelle
Was ist passiert
Gemini 3.5 Pro GA is expected June 23–30 with a 2M-token context window and Deep Think reasoning.
Warum es wichtig ist
Google is timing this against GPT-5.6 and Fable 5's paywall in the busiest frontier-model release week of 2026.
Was zu tun ist
Google Cloud teams should wait for GA. Everyone else, hold until early July when all three models are live and benchmarked.

Urteil: Google platziert Gemini 3.5 Pro GA direkt gegen GPT-5.6 und Claude Fable 5s Paywall-Übergang. Juni 2026 ist der wichtigste Monat in der Geschichte der Frontier-Modell-Veröffentlichungen — drei Modelle landen innerhalb von 10 Tagen, und Google hat ein Zeitfenster.

Was passiert ist

Laut Analyse von andrew.ooo (andrew.ooo, 2026(wird in einem neuen Tab geöffnet)) stellt sich der Zeitplan für Ende Juni wie folgt dar:

EreignisDatumStatus
Claude Fable 5 Launch9. Juni 2026Veröffentlicht
Fable 5 Paywall22. Juni 2026Steht bevor
Gemini 3.5 Pro GA23.–30. Juni 2026Erwartet
GPT-5.6 LaunchEnde Juni / Anfang JuliErwartet

Diese Bündelung ist kein Zufall. Jeder Anbieter positioniert sich für maximale Aufmerksamkeit. Fable 5, über das wir zum Launch berichteten, ging am 22. Juni hinter eine Paywall. Gemini 3.5 Pros Zeitfenster zieht Aufmerksamkeit von diesem Übergang ab. GPT-5.6 reitet auf dem Post-Paywall-Pressezyklus und landet vor der US-Sommerflauten.

Was Gemini 3.5 Pro bringt

  • 2M-Token-Kontextfenster — der strukturelle Spitzenreiter, 2× Fable 5s 1M und deutlich vor GPT-5.6s erwarteten 200K–1M
  • Deep Think Reasoning-Modus — Googles Antwort auf Claude Extended Thinking und OpenAIs o-Serie
  • Nativ multimodal — Bild-, Video-, Audio-Unterstützung, die weder Anthropic noch OpenAI derzeit in Frontier-Qualität erreichen
  • Erwartete Preise: 4–6 $ / 20–30 $ pro 1M Tokens — Google unterbietet traditionell beim Preis, was Gemini 3.5 Pro zur kostengünstigsten Frontier-Option macht

Warum es wichtig ist

Im SWE-bench Pro: Fable 5 führt mit ~69,2 %, Gemini 3.5 Pro bei ~65–67 % in Preview-Benchmarks. GPT-5.6 wird erwartet, Fable 5 zu erreichen oder marginal zu übertreffen. Für alltägliche Coding-Aufgaben, die in 200K Kontext passen, sind diese Unterschiede marginal.

Für Workloads, die wirklich 1M+ Kontext benötigen — ganze Monorepo-Refactorings, Multi-Dokument-Analyse, Langhorizont-Agent-Läufe — ist Gemini 3.5 Pro der strukturelle Gewinner. Das 2M-Kontextfenster ist kein geringfügiger Spezifikationssprung; es ist eine Fähigkeitskategorie, in der kein anderes Frontier-Modell mithalten kann.

Die Ökosystem-Passung zählt mehr als rohe Benchmarks. Google Workspace-Nutzer erhalten native Integration zu null Migrationskosten. Anthropic-Nutzer bleiben bei Claude Code und MCP-Servern. OpenAI-Nutzer bleiben bei ChatGPT und Codex. Für die meisten Teams ist der richtige Schritt, innerhalb des aktuellen Anbieters ein Upgrade durchzuführen — nicht zu wechseln.

Was sich für dich ändert

Wenn du auf Google Cloud oder Workspace bist: Warte auf Gemini 3.5 Pro GA. Das 2M-Kontextfenster plus Googles historisch aggressive Preisgestaltung machen es zur rationalen Standardwahl für Google-Ökosystem-Teams.

Wenn deine Entscheidung warten kann: Halte bis zur ersten Juli-Woche, wenn alle drei Modelle live sind und unabhängige Benchmarks vorliegen. Claude Fable 5 ist derzeit die sicherste Wahl — bekannte Fähigkeit, bekannte Preise.

Für Gemini 2.5 Pro-Nutzer: Wir bewerten Gemini 2.5 Pro derzeit als Recommended — die budgetfreundliche Langkontext-Wahl. Wir werden dieses Urteil neu bewerten, sobald 3.5 Pro live und benchmarkt ist. Wenn 3.5 Pro wettbewerbsfähige Fähigkeiten zu einem ähnlichen Kostenprofil liefert, könnte sich die 2.5 Pro-Empfehlung verengen.

FAQ

Wann genau geht Gemini 3.5 Pro in GA? Das erwartete Zeitfenster ist 23.–30. Juni 2026. Google hat kein spezifisches Datum angekündigt, aber das Timing ergibt sich aus dem Wettbewerbskalender — Fable 5s Paywall-Übergang am 22. Juni und GPT-5.6s erwarteter Launch Ende Juni.

Ist 2M Kontext tatsächlich nutzbar? Ja — anders als einige Modelle, die hohen Kontext bewerben, aber in der Qualität zum Limit hin abfallen, hat Googles Gemini-Architektur historisch starken Recall über das gesamte Kontextfenster hinweg geliefert. Die 2M-Zahl repräsentiert nutzbaren Kontext, nicht nur theoretische Kapazität.

Sollte ich dafür den Anbieter wechseln? Wahrscheinlich nicht. Es sei denn, dein Workload erfordert wirklich 2M Kontext — und die meisten tun das nicht — überwiegen die Wechselkosten (Ökosystem, Tooling, Umschulung) den marginalen Benchmark-Unterschied zwischen Frontier-Modellen. Upgrade innerhalb deines Anbieters; migriere nicht.

Betroffene Tools & Modelle

Gemini 3.5 ProGemini 2.5 Pro

Nie wieder etwas verpassen

Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.

Mit dem Abonnieren stimmst du unserer Datenschutzerklärung zu. Jederzeit abbestellbar.