O AGENTICO
Gemini 3.5 Transcribe
modelo · 6 menções
Menções

O Gemini 3.5 Transcribe pode transcrever em tempo real ou processar áudio pré-gravado, e já está disponível no Gboard e no app Gemini para macOS, além de ser anunciado para o Chrome.
Amplia o alcance do modelo, indicando que a tecnologia não se limita ao Pixel 11 e pode ser usada em outras plataformas.

O Google lançou o Gemini 3.5 Transcribe, um modelo de transcrição de fala para texto que suporta mais de 85 idiomas e remove palavras de enchimento.
O novo modelo de transcrição do Google é mais preciso e suporta muitos idiomas, limpando o discurso de palavras como 'ums' e 'ahs'.

O Gemini 3.5 Transcribe suporta a identificação de múltiplos falantes e fornece timestamps em nível de palavra.
Essas funcionalidades são cruciais para aplicações como transcrição de reuniões e análise de chamadas.

O Gemini 3.5 Transcribe lida com autocorreções e remove palavras de preenchimento como 'ums' e 'ahs' do texto final.
Isso melhora a qualidade da transcrição, tornando-a mais natural e útil para aplicações de voz.

O Gemini 3.5 Transcribe alcança uma taxa média de erro de palavra (WER) de 4,0% para streaming e 2,6% para processamento de áudio pré-gravado.
Esses índices demonstram uma precisão alta, especialmente em ambientes ruidosos, justificando a afirmação de ser o modelo mais preciso até o momento.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.