Google DeepMind lança Gemini 3.8 Live e 3.8 Live Extended Thinking com foco em latência e chamada de ferramentas
16 de setembro de 2026
O Google DeepMind apresentou o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking, versões voltadas a interações em tempo real com baixa latência e chamada avançada de ferrament...
O Google DeepMind apresentou o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking, duas novas versões de seu modelo de IA voltadas a interações em tempo real. Segundo o anúncio oficial, o destaque é a combinação de baixa latência, fluidez de resposta e capacidades avançadas de chamada de ferramentas — a habilidade de acionar serviços, APIs e sistemas corporativos no meio de uma conversa. O lançamento também inclui a marca d'água SynthID e parcerias com empresas como Salesforce, ServiceNow e Genspark.
O movimento consolida uma lógica que vem se firmando nos modelos de fronteira: dividir a experiência em dois modos. Um rápido, para conversa contínua; outro lento, para problemas que exigem raciocínio mais longo.
O que muda no Gemini 3.8 Live e Live Extended Thinking?
O foco declarado é tempo de resposta curto e fluidez — a sensação de conversar com algo que não trava a cada frase. O modo Live prioriza o ritmo da interação, enquanto o Extended Thinking aceita um tempo maior de processamento em troca de respostas mais elaboradas quando a tarefa pede análise cuidadosa.
A novidade se encaixa numa linha que o Google já vinha construindo. No Google I/O 2026, a empresa mostrou o Gemini 3.5 Flash, otimizado justamente para agentes e uso em plataformas corporativas — leia mais na nossa cobertura do Google lança Gemini 3.5 Flash otimizado para agentes e Omni. O 3.8 Live dá um passo adiante ao colocar a interatividade em tempo real no centro do produto, não como recurso acessório.
Por que a chamada de ferramentas é o destaque técnico do Gemini 3.8 Live?
Chamada de ferramentas (tool calling) é o mecanismo que permite a um modelo não apenas responder, mas agir: consultar um banco de dados, abrir um ticket, disparar um fluxo de trabalho ou puxar informação de um CRM. Quanto mais fluida essa capacidade dentro de uma conversa em tempo real, mais perto o assistente chega de um operador de verdade.
É aí que o anúncio conversa com a corrida por latência ultrabaixa. Provedores de infraestrutura vêm lançando soluções específicas para inferência rápida, como mostramos na cobertura da solução conjunta de AMD e Cerebras para inferência com latência ultrabaixa. Resposta rápida é pré-requisito para qualquer agente que precise agir enquanto o usuário ainda está falando.
Parcerias do Gemini 3.8 Live com Salesforce, ServiceNow e Genspark
Para explorar os novos recursos, a DeepMind firmou parcerias com companhias como Salesforce, ServiceNow e Genspark. São nomes coerentes com a proposta: Salesforce e ServiceNow dominam sistemas de gestão de clientes e de fluxos de trabalho empresariais — territórios onde um assistente capaz de chamar ferramentas tem uso imediato. Já a Genspark atua no campo de agentes e busca com IA.
O que o anúncio não diz é igualmente relevante: não há detalhamento de escopo, prazos, exclusividade ou quais produtos específicos de cada parceira receberão os recursos primeiro.
SynthID e transparência no conteúdo gerado pelo Gemini 3.8 Live
O lançamento inclui a marca d'água SynthID, tecnologia do Google que insere um sinal imperceptível em conteúdo produzido por IA para permitir identificação posterior. Na prática, é uma resposta à pressão crescente por rastreabilidade — saber se um texto, áudio ou vídeo saiu de um modelo.
Vale o alerta: marca d'água não equivale a detecção infalível. Ela ajuda a verificar procedência, mas depende de adoção ampla e de ferramentas compatíveis para ter utilidade real no dia a dia.
O que o anúncio do Gemini 3.8 Live ainda não responde
Não há benchmarks comparativos, preços, datas de disponibilidade geral nem limites de uso divulgados. Também não está claro em quais regiões o Gemini 3.8 Live chega primeiro. Para quem desenvolve no Brasil, isso significa aguardar documentação de API e política de preços antes de planejar integrações — mas o recado já está dado: a disputa de 2026 é menos sobre "quem responde melhor" e mais sobre quem responde rápido o bastante para agir.
Perguntas Frequentes sobre o Gemini 3.8 Live
O que é o Gemini 3.8 Live?
É uma versão do modelo de IA do Google DeepMind voltada a interações em tempo real, com foco em baixa latência, fluidez e capacidade de chamar ferramentas externas durante a conversa.Qual a diferença entre 3.8 Live e 3.8 Live Extended Thinking?
O modo Live prioriza velocidade de resposta; o Extended Thinking adiciona raciocínio mais longo e aprofundado quando a tarefa exige análise mais cuidadosa.O que a marca d'água SynthID faz?
Insere um sinal imperceptível em conteúdo gerado por IA para ajudar a identificar sua origem e reforçar a transparência — embora não substitua verificação independente.Fonte: deepmind.google
Escrito por
Lucas MontarroiosSou Lucas Montarroios e dediquei os últimos 15 anos à linha de frente de operações de telecom e data centers. Minha carreira sempre foi pautada por um foco implacável: transformar tecnologia e cenários críticos em oportunidades reais de negócio. No novidades.ia.br, trago essa visão executiva para o universo da IA. Especialista em produtos, mercado e ferramentas práticas de IA. Minha missão aqui é filtrar o ruído do mercado, analisando benchmarks, estratégias de grandes empresas e ferramentas práticas.