Google lanzó Gemini 3.8 Flash TTS y Gemini 3.8 Flash-Lite TTS el 23 de septiembre, incorporando un modelo de voz más expresivo junto con una opción de menor coste para tareas de audio de gran volumen.
En el anuncio de Google, la empresa afirma que Flash está orientado a una producción de voz más dirigida, mientras que Flash-Lite está diseñado para cargas de trabajo sensibles al rendimiento. Flash permite diseñar voces mediante prompts en más de 100 idiomas y dialectos, y Google indica que los creadores también pueden utilizar una biblioteca de más de 2.000 voces predefinidas.
Google también condiciona la replicación de voz: la clonación requiere una muestra de 30 segundos y una grabación de consentimiento hablado correspondiente del propietario de la voz. Los modelos también admiten control de interpretación línea por línea, generación de formato largo y escenas con dos interlocutores. El despliegue comenzó en Google AI Studio y la API de Gemini el 23 de septiembre, aunque la replicación de voz no está disponible en el EEE, Reino Unido, Suiza, India, Illinois ni Texas.
