Latenode

Google lança Gemini 3.8 TTS com clonagem de voz mediante consentimento

Builders podem dividir a narração premium e a geração de fala em massa entre dois modelos, mas fluxos com vozes clonadas agora exigem verificações explícitas de consentimento e tratamento conforme a região.

Interface do Gemini para geração de fala e clonagem de voz

O Google lançou o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS em 23 de setembro, adicionando um modelo de fala com maior expressividade ao lado de uma opção de menor custo para trabalhos de áudio em alto volume.

No anúncio do Google, a empresa afirma que o Flash é voltado à produção de voz com mais direcionamento, enquanto o Flash-Lite foi criado para cargas de trabalho sensíveis a throughput. O Flash oferece suporte ao design de voz baseado em prompts em mais de 100 idiomas e dialetos, e o Google afirma que builders também podem usar uma biblioteca com mais de 2.000 vozes predefinidas.

O Google também está restringindo a replicação de voz: a clonagem exige uma amostra de 30 segundos e uma gravação de consentimento falado correspondente do proprietário da voz. Os modelos também oferecem suporte a controle de entrega linha por linha, geração de conteúdo longo e cenas com dois falantes. A disponibilização começou no Google AI Studio e na API Gemini em 23 de setembro, embora a replicação de voz não esteja disponível no EEE, Reino Unido, Suíça, Índia, Illinois e Texas.

Quando modelos e APIs mudam o fluxo continua rodando

Conecte em um único cenário os modelos e apps de notícias como esta. Se um provedor mudar roteamento, preço ou disponibilidade, você atualiza o fluxo — sem recomeçar do zero.

Começar grátis

Plano gratuito para sempre. Não é necessário cartão de crédito.