O Google lançou o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS em 23 de setembro, adicionando um modelo de fala com maior expressividade ao lado de uma opção de menor custo para trabalhos de áudio em alto volume.
No anúncio do Google, a empresa afirma que o Flash é voltado à produção de voz com mais direcionamento, enquanto o Flash-Lite foi criado para cargas de trabalho sensíveis a throughput. O Flash oferece suporte ao design de voz baseado em prompts em mais de 100 idiomas e dialetos, e o Google afirma que builders também podem usar uma biblioteca com mais de 2.000 vozes predefinidas.
O Google também está restringindo a replicação de voz: a clonagem exige uma amostra de 30 segundos e uma gravação de consentimento falado correspondente do proprietário da voz. Os modelos também oferecem suporte a controle de entrega linha por linha, geração de conteúdo longo e cenas com dois falantes. A disponibilização começou no Google AI Studio e na API Gemini em 23 de setembro, embora a replicação de voz não esteja disponível no EEE, Reino Unido, Suíça, Índia, Illinois e Texas.
