Quinta-feira, 24 de setembro de 2026

O AGENTICO

o futuro da IA, todo dia, num clique

Voltarver como story →

Google lança dois modelos de texto para fala Gemini 3.8 Flash TTS

4 fontesdesde 23 de setembro de 20264 artigos

O Google disponibilizou hoje dois novos modelos de conversão de texto em fala, o Gemini 3.8 Flash TTS e o Flash-Lite TTS. O Flash TTS permite criar vozes personalizadas a partir de descrições em texto e amostras de áudio de 30 segundos, enquanto o Flash-Lite é voltado para geração em larga escala e baixo custo.

Resumo

  • Google lançou dois modelos de texto para fala: Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS.

    O anúncio marca a expansão da família de modelos de áudio da Google, com foco em criação de voz personalizada e eficiência.

  • O Gemini 3.8 Flash TTS permite criar vozes a partir de descrições em texto e com amostra de áudio de 30 segundos.

    A criação de vozes personalizadas a partir de prompts e amostras curtas é uma funcionalidade inédita que amplia as possibilidades criativas para desenvolvedores e criadores.

  • Os modelos suportam mais de 100 idiomas, sendo 130 para Flash TTS e 101 para Flash-Lite TTS.

    A ampla cobertura de idiomas indica que os modelos podem ser usados globalmente em aplicações de dublagem e voz.

  • Ambos os modelos oferecem uma biblioteca de mais de 2.000 vozes pré-definidas e permitem adicionar direções de palco e sons não verbais como risadas e suspiros.

    As opções de personalização avançada ampliam o controle criativo sobre a interpretação, tornando a fala gerada mais natural e expressiva.

  • Os modelos estão disponíveis via Gemini API e Google AI Studio, com acesso ao Gemini Enterprise API planejado para depois.

    A disponibilização na plataforma de desenvolvimento permite que empresas e desenvolvedores integrem rapidamente as novas capacidades de voz.

Todo dia, só o que dois veículos independentes confirmaram — no seu feed.

Siga @oagentico →