O Google anunciou em 15 de setembro de 2026 o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking, os modelos que agora alimentam o Gemini 3.8 busca por voz no Search Live, o modo de voz dentro do Modo IA do Google. A diferença central: o modelo responde, raciocina e executa tarefas sem pausar a conversa.

O que muda no Gemini 3.8 busca por voz

O Gemini 3.8 Live processa áudio e imagem ao mesmo tempo, aceita frames de vídeo durante chamadas de voz e executa chamadas de API em segundo plano enquanto mantém a conversa ativa. Não há a pausa de "processando" que caracterizava as versões anteriores.

O modelo detecta e troca de idioma no meio da conversa, com suporte automático a 97 línguas. Para usuários brasileiros, isso significa que uma conversa que começa em português pode alternar para inglês técnico e voltar sem que o sistema trave ou peça confirmação.

Nos benchmarks, o Gemini 3.8 Live ficou em 1° lugar no índice de qualidade Speech to Speech da Artificial Analysis, com 82,6 pontos. No teste agentivo τ-Voice, completou 68,6% das tarefas, liderando o campo. No teste de raciocínio de áudio Big Bench Audio, registrou 97,7%.

O Gemini 3.8 busca por voz passou a alimentar o Search Live, o recurso de voz do Modo IA do Google Search, que está em expansão gradual. Quem já tem acesso ao Modo IA vê o Search Live ganhar respostas mais longas e contextuais por voz.

Extended Thinking: Gmail Live, Docs e Keep

O Gemini 3.8 Live Extended Thinking é a variante para tarefas de múltiplos passos. A diferença em relação ao modelo base: ele não fica em silêncio enquanto raciocina. Usa frases curtas como "Deixa eu verificar..." para manter a conversa viva enquanto processa em segundo plano, depois narra o progresso conforme avança.

Esse modelo chega ao Gemini Live, ao Gmail Live (busca conversacional no e-mail), ao Docs Live (geração e edição de texto por voz) e ao Keep Live (notas por voz). Para quem usa o Google Workspace no dia a dia, tarefas como redigir um e-mail, criar um resumo de reunião ou organizar notas por comando de voz ficam mais precisas quando o contexto é longo ou tem várias etapas.

O modelo base Gemini 3.8 Live ficou em 2° lugar no Speech Agent Arena, avaliação baseada em preferência humana. Para o Extended Thinking, o Google cita "capacidades de raciocínio fortes mantendo um ponto de preço competitivo em relação a outros modelos de fronteira."

Por que isso importa para o seu negócio

O Gemini 3.8 busca por voz marca uma mudança de posição do Google: a interface de voz passou a ser tratada como prioridade, não como acessório. Para quem tem presença no Google, isso altera como o algoritmo lê e cita conteúdo.

Quando alguém fala com o Search Live, as perguntas são mais longas e conversacionais. "Qual ferramenta de IA para criar roteiro de vídeo no celular funciona offline?" é a forma oral; no texto, a pessoa digitaria "IA para roteiro offline". O Gemini 3.8 Flash para programação já mostrou como a família 3.8 prioriza respostas diretas e verificáveis.

Conteúdo que responde perguntas completas, com dados e exemplos concretos, tem mais chance de ser citado pelo Search Live do que páginas genéricas com palavras-chave soltas. Velocidade de carregamento também pesa: o modelo executa tarefas em segundo plano sem pausas, mas o site precisa responder rápido para entrar no contexto.

Para desenvolvedores e empresas que querem construir assistentes de voz, os dois modelos estão disponíveis via Live API e Google AI Studio. Parceiros como Salesforce, LiveKit e LangChain já anunciaram integrações.


Conteúdo reescrito e traduzido para PT pela redação luiscortex, revisado por humano.

Fontes: