Gemini 3.8 Flash TTS e Flash-Lite TTS chegam à Gemini API a $9 e $6 por 1M de tokens de áudio, e as duas tarifas dobram em 1º de janeiro
- O que aconteceu
- Google shipped Gemini 3.8 Flash TTS and Flash-Lite TTS to the Gemini API and AI Studio on 23 September 2026, at $9.00 and $6.00 per 1M audio output tokens.
- Porque é importante
- Both undercut Gemini 3.1 Flash TTS Preview's $20.00 today, but every 3.8 rate doubles on 1 January 2027.
- O que fazer
- Test gemini-3.8-flash-tts or gemini-3.8-flash-lite-tts against your current TTS model, and budget at the 2027 rates.
Nosso veredito: condicional para os dois. Se você gera fala com o Gemini 3.1 Flash TTS Preview, teste agora o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS: os dois são mais baratos por token de áudio hoje, e o Flash TTS continua mais barato mesmo depois do reajuste. A condição é o calendário. Todas as tarifas do 3.8 dobram em 1º de janeiro de 2027, e os rankings de qualidade que o Google cita são o relato do próprio Google sobre um benchmark de terceiros, não algo que nós medimos. Dimensione qualquer carga de trabalho com as tarifas de 2027 antes de migrá-la.
O que aconteceu
O Google anunciou o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS em 23 de setembro de 2026. Os dois estão disponíveis "hoje" na Gemini API e no Google AI Studio. O Flash TTS também está no Gemini Notebook, e o Flash-Lite TTS no Google Vids. A Gemini Enterprise API chega "em breve".
- Cobertura: "mais de 100 idiomas" e "mais de 2.000 vozes prontas para produção", segundo o post de lançamento do Google.
- Procedência: todo clipe recebe marca d'água SynthID, e o Google adiciona credenciais C2PA.
- Replicação de voz: o Google diz que é possível replicar uma voz a partir de "uma amostra de áudio de 30 segundos", com verificação de consentimento integrada.
A página de preços da Gemini API lista estas tarifas por 1M de tokens:
| Modelo (ID na API) | Entrada de texto | Saída de áudio | A partir de 1º jan. 2027 (entrada / saída) |
|---|---|---|---|
Gemini 3.8 Flash TTS (gemini-3.8-flash-tts) | $0,50 | $9,00 | $1,00 / $18,00 |
Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts) | $0,50 | $6,00 | $1,00 / $12,00 |
Gemini 3.1 Flash TTS Preview (gemini-3.1-flash-tts-preview) | $1,00 | $20,00 | nenhuma alteração listada |
O processamento em lote custa metade da tarifa padrão nos dois modelos 3.8 ($4,50 e $3,00 por 1M de tokens de saída de áudio até 31 de dezembro de 2026), e o nível gratuito cobre os dois.
Por que isso importa
A diferença de preço é a notícia. A saída de áudio do Flash TTS custa hoje 55% menos que a do preview 3.1, e a do Flash-Lite TTS, 70% menos. Depois de 1º de janeiro, o Flash TTS ($18,00) ainda fica abaixo dos $20,00 do preview, e o Flash-Lite TTS ($12,00) continua 40% abaixo. A entrada de texto custa agora metade do $1,00 do preview e passa a igualá-lo em 2027.
Isso torna a migração a partir do preview uma decisão fácil só pelo custo. O que mantém os dois modelos em condicional, e não em recomendado:
- As tarifas de lançamento são temporárias. Um orçamento construído sobre $9,00 ou $6,00 quebra em 1º de janeiro de 2027.
- A qualidade é relatada pelo Google. O Google diz que o Flash TTS ficou com o "primeiro lugar geral no Voice Design Benchmark da Hume AI (71,4)" e que os dois modelos ficaram com o "primeiro e o segundo lugares, respectivamente, no Overall Quality Index da Hume AI". São citações do Google sobre um benchmark de terceiros. Não executamos nenhum dos dois modelos.
- A replicação de voz tem restrição regional. "A replicação de voz pelo AI Studio não está disponível em Illinois, Texas, EEE, Reino Unido, Suíça e Índia."
O que muda para você
- Se você está no preview 3.1: passe os seus roteiros atuais por
gemini-3.8-flash-ttsegemini-3.8-flash-lite-ttse compare lado a lado a qualidade da saída e o custo. - Escolha do nível: o Flash-Lite TTS é o nível de custo para narração em alto volume e para cascatas de agentes de voz; o Flash TTS é o que vale testar para vozes expressivas ou de personagens.
- Orçamento: dimensione cargas de trabalho de longa duração com $18,00 e $12,00 por 1M de tokens de saída de áudio, e não com as tarifas de 2026. Use o processamento em lote onde a latência permitir para reduzir qualquer um dos valores à metade.
- Replicação de voz: se seus usuários ou sua equipe estiverem em Illinois, Texas, no EEE, no Reino Unido, na Suíça ou na Índia, o recurso de replicação do AI Studio não está disponível para eles.
O que fazer
- 1 If you use gemini-3.1-flash-tts-preview, run the same scripts through gemini-3.8-flash-tts and gemini-3.8-flash-lite-tts and compare quality and cost.
- 2 Size any long-running workload at the rates from 1 January 2027 ($18.00 and $12.00 per 1M audio output tokens), not the 2026 rates.
- 3 If you plan to use voice replication, check the geographic exclusions first: Illinois, Texas, the EEA, the UK, Switzerland and India.
Ferramentas e modelos afetados
Nunca mais precisas de te pôr a par
O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.