Quinta-feira, 24 de setembro de 2026

O AGENTICO

o futuro da IA, todo dia, num clique

Voltarver como story →

Google Deepmind lança Gemini 3.8 Live e Extended Thinking para voz

8 fontesdesde 15 de setembro de 20268 artigos

O Google Deepmind anunciou dois novos modelos de IA para voz: Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, voltados para conversas mais naturais e tarefas complexas. O Extended Thinking lidera o índice de qualidade de fala da Artificial Analysis com 82.6, superando concorrentes como o GPT-Live-1 da OpenAI, e está sendo distribuído para o Gemini Live.

Resumo

  • O Google Deepmind lançou dois novos modelos de IA: Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking.

    O anúncio oficial apresenta duas novas ferramentas para desenvolvedores, com foco em voz e tarefas complexas.

  • O Gemini 3.8 Live Extended Thinking lidera o índice de qualidade de fala da Artificial Analysis com uma pontuação de 82.6.

    O modelo se destaca em benchmarks de terceiros, superando concorrentes como a OpenAI em qualidade de conversação.

  • O Gemini 3.8 Live custa US$ 0.005 por minuto de áudio de entrada e US$ 0.018 por minuto de saída, enquanto o GPT-Live-1 da OpenAI custa US$ 0.05 por minuto.

    O preço mais baixo é um diferencial competitivo chave, tornando a solução do Google mais acessível para desenvolvedores.

  • Os novos modelos estão disponíveis para desenvolvedores através da API Gemini e do Google AI Studio, com aplicativos de exemplo no GitHub.

    A disponibilidade para terceiros é fundamental para que o ecossistema de desenvolvedores possa integrar as tecnologias em produtos próprios.

  • O Gemini 3.8 Live pode executar chamadas de API em segundo plano durante uma conversa por voz.

    Isso permite que o usuário faça um pedido enquanto a IA trabalha em tarefas complexas sem interromper o diálogo.

  • O Gemini 3.8 Live suporta mais de 97 idiomas e pode alternar automaticamente entre eles em uma conversa.

    Isso torna o modelo útil para comunicação global e contextos multilíngues.

  • O Gemini 3.8 Live Extended Thinking alcançou 68,6% no benchmark τ-Voice de conclusão de tarefas agênticas.

    Isso indica superioridade em tarefas complexas que exigem raciocínio de múltiplas etapas.

  • O Gemini 3.8 Live Extended Thinking pontuou 97,7% no benchmark Big Bench Audio de raciocínio.

    A pontuação demonstra forte capacidade de compreensão auditiva e raciocínio lógico.

  • O Gemini 3.8 Live Extended Thinking está começando a ser distribuído para o Gemini Live.

    Isso significa que usuários do app Gemini Live poderão acessar o modelo com raciocínio avançado.

  • O Google Deepmind anunciou os modelos Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, descrevendo-os como as versões mais avançadas para diálogo em tempo real.

    Anúncio oficial dos dois novos modelos de voz, que representam a aposta do Google em conversas com IA mais fluidas e inteligentes.

  • O Gemini 3.8 Live Extended Thinking é capaz de raciocinar e falar simultaneamente, usando pistas verbais e narração de progresso para realizar tarefas complexas.

    Recurso-chave do modelo avançado: permite processamento de raciocínio em múltiplas etapas sem interromper o fluxo da conversa.

  • Os modelos estão disponíveis para desenvolvedores por meio da API Gemini, do Google AI Studio e do GitHub, além de estarem integrados a ferramentas como Gmail Live, Docs Live e Keep Live.

    Acessibilidade e integração ampla facilitam a adoção pelos desenvolvedores e o uso em produtos já existentes do Google.

  • O Gemini 3.8 Live alcançou o segundo lugar no benchmark Speech Agent Arena e liderou o EVA-Bench da ServiceNow.

    Resultados competitivos no mercado de agentes de voz mostram o posicionamento forte do modelo base em tarefas práticas.

  • O Gemini 3.8 Live Extended Thinking alcançou 35,1% no benchmark τ-Voice-banking da Sierra.

    Resultado específico em tarefas bancárias agênticas, indicando o potencial do modelo em aplicações de alto valor como finanças.

Todo dia, só o que dois veículos independentes confirmaram — no seu feed.

Siga @oagentico →