Gemini 3.8 Flash TTS e Flash-Lite TTS chegam à Gemini API a $9 e $6 por 1M de tokens de áudio, e as duas tarifas dobram em 1º de janeiro

Google logoGoogleImportante3 de outubro de 2026Modelos
O que aconteceu
Google shipped Gemini 3.8 Flash TTS and Flash-Lite TTS to the Gemini API and AI Studio on 23 September 2026, at $9.00 and $6.00 per 1M audio output tokens.
Porque é importante
Both undercut Gemini 3.1 Flash TTS Preview's $20.00 today, but every 3.8 rate doubles on 1 January 2027.
O que fazer
Test gemini-3.8-flash-tts or gemini-3.8-flash-lite-tts against your current TTS model, and budget at the 2027 rates.

Nosso veredito: condicional para os dois. Se você gera fala com o Gemini 3.1 Flash TTS Preview, teste agora o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS: os dois são mais baratos por token de áudio hoje, e o Flash TTS continua mais barato mesmo depois do reajuste. A condição é o calendário. Todas as tarifas do 3.8 dobram em 1º de janeiro de 2027, e os rankings de qualidade que o Google cita são o relato do próprio Google sobre um benchmark de terceiros, não algo que nós medimos. Dimensione qualquer carga de trabalho com as tarifas de 2027 antes de migrá-la.

O que aconteceu

O Google anunciou o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS em 23 de setembro de 2026. Os dois estão disponíveis "hoje" na Gemini API e no Google AI Studio. O Flash TTS também está no Gemini Notebook, e o Flash-Lite TTS no Google Vids. A Gemini Enterprise API chega "em breve".

  • Cobertura: "mais de 100 idiomas" e "mais de 2.000 vozes prontas para produção", segundo o post de lançamento do Google.
  • Procedência: todo clipe recebe marca d'água SynthID, e o Google adiciona credenciais C2PA.
  • Replicação de voz: o Google diz que é possível replicar uma voz a partir de "uma amostra de áudio de 30 segundos", com verificação de consentimento integrada.

A página de preços da Gemini API lista estas tarifas por 1M de tokens:

Modelo (ID na API)Entrada de textoSaída de áudioA partir de 1º jan. 2027 (entrada / saída)
Gemini 3.8 Flash TTS (gemini-3.8-flash-tts)$0,50$9,00$1,00 / $18,00
Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts)$0,50$6,00$1,00 / $12,00
Gemini 3.1 Flash TTS Preview (gemini-3.1-flash-tts-preview)$1,00$20,00nenhuma alteração listada

O processamento em lote custa metade da tarifa padrão nos dois modelos 3.8 ($4,50 e $3,00 por 1M de tokens de saída de áudio até 31 de dezembro de 2026), e o nível gratuito cobre os dois.

Por que isso importa

A diferença de preço é a notícia. A saída de áudio do Flash TTS custa hoje 55% menos que a do preview 3.1, e a do Flash-Lite TTS, 70% menos. Depois de 1º de janeiro, o Flash TTS ($18,00) ainda fica abaixo dos $20,00 do preview, e o Flash-Lite TTS ($12,00) continua 40% abaixo. A entrada de texto custa agora metade do $1,00 do preview e passa a igualá-lo em 2027.

Isso torna a migração a partir do preview uma decisão fácil só pelo custo. O que mantém os dois modelos em condicional, e não em recomendado:

  • As tarifas de lançamento são temporárias. Um orçamento construído sobre $9,00 ou $6,00 quebra em 1º de janeiro de 2027.
  • A qualidade é relatada pelo Google. O Google diz que o Flash TTS ficou com o "primeiro lugar geral no Voice Design Benchmark da Hume AI (71,4)" e que os dois modelos ficaram com o "primeiro e o segundo lugares, respectivamente, no Overall Quality Index da Hume AI". São citações do Google sobre um benchmark de terceiros. Não executamos nenhum dos dois modelos.
  • A replicação de voz tem restrição regional. "A replicação de voz pelo AI Studio não está disponível em Illinois, Texas, EEE, Reino Unido, Suíça e Índia."

O que muda para você

  • Se você está no preview 3.1: passe os seus roteiros atuais por gemini-3.8-flash-tts e gemini-3.8-flash-lite-tts e compare lado a lado a qualidade da saída e o custo.
  • Escolha do nível: o Flash-Lite TTS é o nível de custo para narração em alto volume e para cascatas de agentes de voz; o Flash TTS é o que vale testar para vozes expressivas ou de personagens.
  • Orçamento: dimensione cargas de trabalho de longa duração com $18,00 e $12,00 por 1M de tokens de saída de áudio, e não com as tarifas de 2026. Use o processamento em lote onde a latência permitir para reduzir qualquer um dos valores à metade.
  • Replicação de voz: se seus usuários ou sua equipe estiverem em Illinois, Texas, no EEE, no Reino Unido, na Suíça ou na Índia, o recurso de replicação do AI Studio não está disponível para eles.

O que fazer

  1. 1 If you use gemini-3.1-flash-tts-preview, run the same scripts through gemini-3.8-flash-tts and gemini-3.8-flash-lite-tts and compare quality and cost.
  2. 2 Size any long-running workload at the rates from 1 January 2027 ($18.00 and $12.00 per 1M audio output tokens), not the 2026 rates.
  3. 3 If you plan to use voice replication, check the geographic exclusions first: Illinois, Texas, the EEA, the UK, Switzerland and India.

Ferramentas e modelos afetados

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.