Gemini 3.8 Flash TTS und Flash-Lite TTS starten in der Gemini API zu 9 $ und 6 $ pro 1 Mio. Audio-Tokens, und beide Preise verdoppeln sich am 1. Januar
- Was ist passiert
- Google shipped Gemini 3.8 Flash TTS and Flash-Lite TTS to the Gemini API and AI Studio on 23 September 2026, at $9.00 and $6.00 per 1M audio output tokens.
- Warum es wichtig ist
- Both undercut Gemini 3.1 Flash TTS Preview's $20.00 today, but every 3.8 rate doubles on 1 January 2027.
- Was zu tun ist
- Test gemini-3.8-flash-tts or gemini-3.8-flash-lite-tts against your current TTS model, and budget at the 2027 rates.
Unser Urteil: Bedingt, bei beiden. Wenn Sie Sprache mit Gemini 3.1 Flash TTS Preview erzeugen, testen Sie jetzt Gemini 3.8 Flash TTS und Gemini 3.8 Flash-Lite TTS: Beide sind heute pro Audio-Token günstiger, und Flash TTS bleibt auch nach dem Preissprung günstiger. Die Bedingung ist der Kalender. Alle 3.8-Preise verdoppeln sich am 1. Januar 2027, und die Qualitätsrankings, die Google anführt, sind Googles eigene Angaben zu einem Drittanbieter-Benchmark, nichts, was wir selbst gemessen haben. Kalkulieren Sie jede Workload mit den Preisen von 2027, bevor Sie sie umstellen.
Was passiert ist
Google hat Gemini 3.8 Flash TTS und Gemini 3.8 Flash-Lite TTS am 23. September 2026 angekündigt. Beide sind „heute“ in der Gemini API und in Google AI Studio verfügbar. Flash TTS steckt außerdem in Gemini Notebook, Flash-Lite TTS in Google Vids. Die Gemini Enterprise API ist „demnächst“ verfügbar.
- Abdeckung: „über 100 Sprachen“ und „über 2.000 produktionsreife Stimmen“, laut Googles Launch-Beitrag.
- Herkunftsnachweis: Jeder Clip erhält ein SynthID-Wasserzeichen, und Google ergänzt C2PA-Credentials.
- Stimmreplikation: Laut Google lässt sich eine Stimme aus „einer 30-Sekunden-Audioprobe“ replizieren, mit integrierter Einwilligungsprüfung.
Die Preisseite der Gemini API nennt diese Preise pro 1 Mio. Tokens:
| Modell (API-ID) | Text-Input | Audio-Output | Ab 1. Jan. 2027 (Input / Output) |
|---|---|---|---|
Gemini 3.8 Flash TTS (gemini-3.8-flash-tts) | 0,50 $ | 9,00 $ | 1,00 $ / 18,00 $ |
Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts) | 0,50 $ | 6,00 $ | 1,00 $ / 12,00 $ |
Gemini 3.1 Flash TTS Preview (gemini-3.1-flash-tts-preview) | 1,00 $ | 20,00 $ | keine Änderung angegeben |
Batch kostet bei beiden 3.8-Modellen die Hälfte des Standardpreises (4,50 $ und 3,00 $ pro 1 Mio. Audio-Output-Tokens bis zum 31. Dezember 2026), und die kostenlose Stufe deckt beide ab.
Warum es wichtig ist
Der Preisabstand ist die Nachricht. Der Audio-Output von Flash TTS kostet heute 55 % weniger als die 3.1 Preview, der von Flash-Lite TTS 70 % weniger. Nach dem 1. Januar liegt Flash TTS (18,00 $) weiterhin unter den 20,00 $ der Preview, und Flash-Lite TTS (12,00 $) liegt weiterhin 40 % darunter. Der Text-Input kostet jetzt halb so viel wie die 1,00 $ der Preview und entspricht ihnen ab 2027.
Allein aus Kostensicht ist der Umstieg von der Preview damit eine einfache Entscheidung. Was beide Modelle bei Bedingt statt bei Empfohlen hält:
- Die Einführungspreise sind befristet. Ein Budget, das auf 9,00 $ oder 6,00 $ aufbaut, kippt am 1. Januar 2027.
- Die Qualitätsangaben stammen von Google. Google sagt, Flash TTS habe „Platz 1 insgesamt im Voice Design Benchmark von Hume AI (71,4)“ belegt, und die beiden Modelle hätten „Platz 1 bzw. Platz 2 im Overall Quality Index von Hume AI“ belegt. Das sind Googles Verweise auf den Benchmark eines Drittanbieters. Wir haben keines der beiden Modelle selbst laufen lassen.
- Stimmreplikation ist regional gesperrt. „Stimmreplikation über AI Studio ist in Illinois, Texas, dem EWR, dem Vereinigten Königreich, der Schweiz und Indien nicht verfügbar.“
Was sich für Sie ändert
- Bei der 3.1 Preview: Lassen Sie Ihre bestehenden Skripte durch
gemini-3.8-flash-ttsundgemini-3.8-flash-lite-ttslaufen und vergleichen Sie Ausgabequalität und Kosten direkt nebeneinander. - Modellwahl: Flash-Lite TTS ist die Budget-Variante für Narration in großem Umfang und Sprachagent-Kaskaden; Flash TTS testen Sie für ausdrucksstarke oder Charakterstimmen.
- Budgetierung: Kalkulieren Sie lang laufende Workloads mit 18,00 $ und 12,00 $ pro 1 Mio. Audio-Output-Tokens, nicht mit den Preisen von 2026. Nutzen Sie Batch, wo die Latenz es erlaubt, um beide Beträge zu halbieren.
- Stimmreplikation: Wenn Ihre Nutzer oder Ihr Team in Illinois, Texas, dem EWR, dem Vereinigten Königreich, der Schweiz oder Indien sitzen, steht ihnen die Replikationsfunktion von AI Studio nicht zur Verfügung.
Was zu tun ist
- 1 If you use gemini-3.1-flash-tts-preview, run the same scripts through gemini-3.8-flash-tts and gemini-3.8-flash-lite-tts and compare quality and cost.
- 2 Size any long-running workload at the rates from 1 January 2027 ($18.00 and $12.00 per 1M audio output tokens), not the 2026 rates.
- 3 If you plan to use voice replication, check the geographic exclusions first: Illinois, Texas, the EEA, the UK, Switzerland and India.
Betroffene Tools & Modelle
Nie wieder etwas verpassen
Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.