O Google anunciou dois novos modelos para integrar o Gemini Audio, sua família de inteligências artificiais conversacionais voltadas a interações por voz.
As novidades são o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking, desenvolvidos para tornar conversas com IA mais rápidas, naturais e inteligentes.
Os modelos chegam com foco em raciocínio em tempo real, interpretação de contexto visual e execução de tarefas em segundo plano. Na prática, a proposta é permitir que a IA mantenha diálogos mais fluidos, compreenda melhor informações recebidas durante a conversa e realize ações sem interromper a experiência do usuário.
Dois modelos para diferentes níveis de complexidade
O Gemini 3.8 Live foi criado para atender interações em escala, combinando inteligência conversacional, respostas rápidas, diálogos naturais e interpretação visual. Ele está disponível para uso no Search Live, recurso de busca por voz do Google.
Já o Gemini 3.8 Live Extended Thinking foi desenvolvido para tarefas mais complexas. Essa versão traz raciocínio aprimorado e capacidade de lidar com processos em múltiplas etapas, sendo disponibilizada no Gemini Live.
O que os novos modelos conseguem fazer
Segundo o Google, os novos modelos ampliam as possibilidades de uso da IA em conversas por voz. Entre os principais recursos estão:
- Execução de chamadas de API e ferramentas em segundo plano, sem interromper a conversa;
- Uso de imagens como parte do contexto do diálogo;
- Análise precisa de sequências alfanuméricas;
- Suporte a múltiplos idiomas;
- Contexto dinâmico, permitindo adicionar dados estruturados à conversa para gerar respostas mais conscientes do conteúdo.
Essas capacidades indicam uma evolução importante nas interfaces conversacionais, aproximando a IA de experiências mais contínuas, úteis e integradas às tarefas do dia a dia.
Desempenho em benchmarks
Nos benchmarks destacados pelo Google, o Gemini 3.8 Live Extended Thinking superou concorrentes como GPT-Live-1 Astra e Grok Think Fast 2.0 no Speech to Speech Index.
Já no quesito Agentic Performance, que avalia capacidades relacionadas à execução de tarefas por agentes de IA, a disputa aparece mais equilibrada entre os modelos comparados.

Google Gemini 3.8 Live supera concorrentes em testes sintéticos. Foto: Google/Reprodução
Conteúdo de áudio com marca d’água SynthID
Assim como em outros recursos generativos da empresa, todo conteúdo de áudio criado pelos novos modelos do Google recebe identificação por meio do SynthID, marca d’água invisível usada para sinalizar materiais gerados por IA.
Disponibilidade para desenvolvedores e usuários
Os novos modelos já estão disponíveis em diferentes plataformas. Para desenvolvedores, o acesso pode ser feito pela API Gemini e pelo Google AI Studio.
Para o público geral, o Gemini 3.8 Live pode ser utilizado no Search Live, recurso de busca por voz do Google. O Gemini 3.8 Live Extended Thinking está disponível no app Gemini, por meio do Gemini Live, e também em integrações com ferramentas do Workspace para assinantes dos planos Google AI Pro e Google AI Ultra.
Além disso, o recurso também chega ao Gmail e ao Keep para usuários de todos os planos Google AI.


