O AGENTICO
Google lança dois modelos de texto para fala Gemini 3.8 Flash TTS
4 fontesdesde 23 de setembro de 20264 artigos
O Google disponibilizou hoje dois novos modelos de conversão de texto em fala, o Gemini 3.8 Flash TTS e o Flash-Lite TTS. O Flash TTS permite criar vozes personalizadas a partir de descrições em texto e amostras de áudio de 30 segundos, enquanto o Flash-Lite é voltado para geração em larga escala e baixo custo.



Resumo
Google lançou dois modelos de texto para fala: Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS.
O anúncio marca a expansão da família de modelos de áudio da Google, com foco em criação de voz personalizada e eficiência.
O Gemini 3.8 Flash TTS permite criar vozes a partir de descrições em texto e com amostra de áudio de 30 segundos.
A criação de vozes personalizadas a partir de prompts e amostras curtas é uma funcionalidade inédita que amplia as possibilidades criativas para desenvolvedores e criadores.
Os modelos suportam mais de 100 idiomas, sendo 130 para Flash TTS e 101 para Flash-Lite TTS.
A ampla cobertura de idiomas indica que os modelos podem ser usados globalmente em aplicações de dublagem e voz.
Ambos os modelos oferecem uma biblioteca de mais de 2.000 vozes pré-definidas e permitem adicionar direções de palco e sons não verbais como risadas e suspiros.
As opções de personalização avançada ampliam o controle criativo sobre a interpretação, tornando a fala gerada mais natural e expressiva.
Os modelos estão disponíveis via Gemini API e Google AI Studio, com acesso ao Gemini Enterprise API planejado para depois.
A disponibilização na plataforma de desenvolvimento permite que empresas e desenvolvedores integrem rapidamente as novas capacidades de voz.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.