O AGENTICO
Google Deepmind lança Gemini 3.8 Live e Extended Thinking para voz
8 fontesdesde 15 de setembro de 20268 artigos
O Google Deepmind anunciou dois novos modelos de IA para voz: Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, voltados para conversas mais naturais e tarefas complexas. O Extended Thinking lidera o índice de qualidade de fala da Artificial Analysis com 82.6, superando concorrentes como o GPT-Live-1 da OpenAI, e está sendo distribuído para o Gemini Live.



Resumo
O Google Deepmind lançou dois novos modelos de IA: Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking.
O anúncio oficial apresenta duas novas ferramentas para desenvolvedores, com foco em voz e tarefas complexas.
O Gemini 3.8 Live Extended Thinking lidera o índice de qualidade de fala da Artificial Analysis com uma pontuação de 82.6.
O modelo se destaca em benchmarks de terceiros, superando concorrentes como a OpenAI em qualidade de conversação.
O Gemini 3.8 Live custa US$ 0.005 por minuto de áudio de entrada e US$ 0.018 por minuto de saída, enquanto o GPT-Live-1 da OpenAI custa US$ 0.05 por minuto.
O preço mais baixo é um diferencial competitivo chave, tornando a solução do Google mais acessível para desenvolvedores.
Os novos modelos estão disponíveis para desenvolvedores através da API Gemini e do Google AI Studio, com aplicativos de exemplo no GitHub.
A disponibilidade para terceiros é fundamental para que o ecossistema de desenvolvedores possa integrar as tecnologias em produtos próprios.
O Gemini 3.8 Live pode executar chamadas de API em segundo plano durante uma conversa por voz.
Isso permite que o usuário faça um pedido enquanto a IA trabalha em tarefas complexas sem interromper o diálogo.
O Gemini 3.8 Live suporta mais de 97 idiomas e pode alternar automaticamente entre eles em uma conversa.
Isso torna o modelo útil para comunicação global e contextos multilíngues.
O Gemini 3.8 Live Extended Thinking alcançou 68,6% no benchmark τ-Voice de conclusão de tarefas agênticas.
Isso indica superioridade em tarefas complexas que exigem raciocínio de múltiplas etapas.
O Gemini 3.8 Live Extended Thinking pontuou 97,7% no benchmark Big Bench Audio de raciocínio.
A pontuação demonstra forte capacidade de compreensão auditiva e raciocínio lógico.
O Gemini 3.8 Live Extended Thinking está começando a ser distribuído para o Gemini Live.
Isso significa que usuários do app Gemini Live poderão acessar o modelo com raciocínio avançado.
O Google Deepmind anunciou os modelos Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, descrevendo-os como as versões mais avançadas para diálogo em tempo real.
Anúncio oficial dos dois novos modelos de voz, que representam a aposta do Google em conversas com IA mais fluidas e inteligentes.
O Gemini 3.8 Live Extended Thinking é capaz de raciocinar e falar simultaneamente, usando pistas verbais e narração de progresso para realizar tarefas complexas.
Recurso-chave do modelo avançado: permite processamento de raciocínio em múltiplas etapas sem interromper o fluxo da conversa.
Os modelos estão disponíveis para desenvolvedores por meio da API Gemini, do Google AI Studio e do GitHub, além de estarem integrados a ferramentas como Gmail Live, Docs Live e Keep Live.
Acessibilidade e integração ampla facilitam a adoção pelos desenvolvedores e o uso em produtos já existentes do Google.
O Gemini 3.8 Live alcançou o segundo lugar no benchmark Speech Agent Arena e liderou o EVA-Bench da ServiceNow.
Resultados competitivos no mercado de agentes de voz mostram o posicionamento forte do modelo base em tarefas práticas.
O Gemini 3.8 Live Extended Thinking alcançou 35,1% no benchmark τ-Voice-banking da Sierra.
Resultado específico em tarefas bancárias agênticas, indicando o potencial do modelo em aplicações de alto valor como finanças.
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.