Google lança dois modelos de texto para fala Gemini 3.8 Flash TTS

23 de setembro de 2026 · 4 fontes independentes

Google lançou dois modelos de texto para fala: Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS.

O anúncio marca a expansão da família de modelos de áudio da Google, com foco em criação de voz personalizada e eficiência.

O Gemini 3.8 Flash TTS permite criar vozes a partir de descrições em texto e com amostra de áudio de 30 segundos.

A criação de vozes personalizadas a partir de prompts e amostras curtas é uma funcionalidade inédita que amplia as possibilidades criativas para…

Os modelos suportam mais de 100 idiomas, sendo 130 para Flash TTS e 101 para Flash-Lite TTS.

A ampla cobertura de idiomas indica que os modelos podem ser usados globalmente em aplicações de dublagem e voz.

Ambos os modelos oferecem uma biblioteca de mais de 2.000 vozes pré-definidas e permitem adicionar direções de palco e sons não verbais como risadas e suspiros.

As opções de personalização avançada ampliam o controle criativo sobre a interpretação, tornando a fala gerada mais natural e expressiva.

Os modelos estão disponíveis via Gemini API e Google AI Studio, com acesso ao Gemini Enterprise API planejado para depois.

A disponibilização na plataforma de desenvolvimento permite que empresas e desenvolvedores integrem rapidamente as novas capacidades de voz.

Confirmado por

  • Google Gemini Blog
  • SiliconANGLE (AI)
  • Simon Willison's Weblog
  • The Decoder
Ler no O agêntico