24 de septiembre de 2026 · Contada por 4 medios
Google lanza Gemini 3.8 Flash TTS con más de 2.000 voces listas
Los dos nuevos modelos de texto a voz permiten diseñar voces desde cero con instrucciones escritas y clonar una a partir de 30 segundos de audio.
Qué ha pasado
Google ha presentado dos modelos de texto a voz (text-to-speech), Gemini 3.8 Flash TTS y Gemini 3.8 Flash-Lite TTS, disponibles en Google AI Studio, la API de Gemini, Gemini Enterprise, Gemini Notebook y Google Vids. Según Google, el primero está pensado para dirección creativa y diseño de personajes: se crean voces desde cero describiéndolas en lenguaje natural, con control línea a línea del ritmo, la emoción, el acento y los sonidos conversacionales, en más de 100 idiomas y dialectos; el segundo se orienta al volumen y al coste, para doblaje, creación de audio y agentes de voz. La biblioteca pasa de 30 voces originales a más de 2.000 listas para producción, con variedades regionales como el español de México, el francés de Quebec o el inglés escocés, y permite replicar un perfil vocal a partir de una muestra de 30 segundos de tu voz o de una voz sobre la que tengas derechos. Google dice haber incluido herramientas de seguridad como marca de agua en el audio generado. El desarrollador Simon Willison ha publicado un playground abierto para probar los modelos con tu propia clave de API.
Por qué importa
La generación de voz deja de ser un catálogo cerrado de locutores sintéticos y pasa a ser configurable por texto, lo que abre la puerta a audiolibros, videojuegos, pódcast y agentes de voz con personajes propios sin grabar a un actor. La clonación a partir de 30 segundos es también el punto delicado: queda por ver cómo se verifica en la práctica que quien sube una muestra tiene derechos sobre esa voz y qué tan robusta resulta la marca de agua.
Qué puedes hacer tú
Si desarrollas, puedes probar ambos modelos en Google AI Studio o a través de la API de Gemini, y comparar Flash TTS con Flash-Lite según lo que te importe, expresividad o coste por volumen. Si trabajas con audio en español, revisa cómo suenan las variedades regionales antes de comprometer un proyecto entero.
Pieza redactada con ayuda de IA a partir de las fuentes citadas y revisada por el equipo de enlaces.ai antes de publicarse. Cómo trabajamos.
En el directorio
Las herramientas de esta noticia
Las que se mencionan en la pieza y otras de las mismas empresas, con nuestra nota.
Sigue leyendo
- 25 de septiembre de 2026 · GoogleGoogle lanza el 1 de octubre su primer satélite con chips de IA
- 25 de septiembre de 2026 · GoogleGoogle lanza Call for Me: Gemini llama a negocios por ti desde el Pixel 11
- 24 de septiembre de 2026 · GoogleYouTube presenta un paquete de herramientas de IA para creadores y espectadores
- 21 de septiembre de 2026 · GoogleGoogle lanza Gemini 3.8 Live y 3.8 Live Extended Thinking para voz