El 22 de septiembre de 2026, según la publicación original enlazada al final, Google anunció disponibilidad general de Gemini 3.8 Flash TTS y Flash-Lite TTS, junto con un endpoint de voces y opciones de diseño y replicación de voz. La replicación incluye controles de consentimiento según el anuncio.
Por qué puede importar
Esta actualización puede ser especialmente útil en aplicaciones donde la claridad y la personalización de la voz son clave, como en la producción de contenido audiovisual, la creación de asistentes virtuales o la generación de materiales didácticos. La capacidad de replicar voces con permiso abre nuevas posibilidades para proyectos que requieren la reproducción de una voz específica, como en la industria del entretenimiento o la publicidad. Sin embargo, es importante destacar que esta función no debe usarse para clonar voces sin consentimiento, y requiere revisar permisos y condiciones aplicables.
Una narración extensa y avisos breves necesitan pruebas distintas de pronunciación y estabilidad. Una demostración agradable no basta para validar nombres propios o información importante.
Qué conviene comprobar
Antes de implementar estos nuevos modelos, es recomendable verificar los requisitos de consentimiento para la replicación de voces y asegurarse de que se cumplen las normas de privacidad y protección de datos. También es útil evaluar cómo se comportan los nuevos modelos en contextos específicos, como en la pronunciación de nombres propios o en la generación de textos largos. Un ejemplo hipotético podría ser un guion narrativo y un aviso breve: ambos requerirían pruebas distintas para comprobar que el resultado sea claro y adecuado para su propósito.
La fecha de esta noticia corresponde al anuncio original. Para utilizar hoy la función o el modelo, consulta su documentación vigente y comprueba las condiciones de tu cuenta. Los ejemplos descritos son hipotéticos; no son resultados de pruebas de Puntoes.