Latenode

Google lanza Gemini 3.8 TTS con clonación de voz con consentimiento

Los creadores pueden repartir la narración premium y la generación masiva de voz entre dos modelos, pero los flujos con voces clonadas ahora requieren comprobaciones de consentimiento explícito y gestión según la región.

Interfaz de Gemini para generación y clonación de voz con consentimiento

Google lanzó Gemini 3.8 Flash TTS y Gemini 3.8 Flash-Lite TTS el 23 de septiembre, incorporando un modelo de voz más expresivo junto con una opción de menor coste para tareas de audio de gran volumen.

En el anuncio de Google, la empresa afirma que Flash está orientado a una producción de voz más dirigida, mientras que Flash-Lite está diseñado para cargas de trabajo sensibles al rendimiento. Flash permite diseñar voces mediante prompts en más de 100 idiomas y dialectos, y Google indica que los creadores también pueden utilizar una biblioteca de más de 2.000 voces predefinidas.

Google también condiciona la replicación de voz: la clonación requiere una muestra de 30 segundos y una grabación de consentimiento hablado correspondiente del propietario de la voz. Los modelos también admiten control de interpretación línea por línea, generación de formato largo y escenas con dos interlocutores. El despliegue comenzó en Google AI Studio y la API de Gemini el 23 de septiembre, aunque la replicación de voz no está disponible en el EEE, Reino Unido, Suiza, India, Illinois ni Texas.

Cuando cambian los modelos y las APIs el flujo sigue en marcha

Conecta en un solo escenario los modelos y apps de noticias como esta. Si un proveedor cambia el enrutado, el precio o la disponibilidad, actualizas el flujo — no empiezas de cero.

Empezar gratis

Plan gratuito para siempre. No se requiere tarjeta de crédito.