O Google apresentou o Gemini 3.8 Live com Live Avatar, uma tecnologia que adiciona uma presença visual às conversas com inteligência artificial.
Em vez de responder apenas por voz ou texto, o sistema gera um avatar animado capaz de falar, movimentar os lábios e reagir com expressões faciais durante a conversa.
A tecnologia foi criada principalmente para aplicações empresariais, como atendimento ao cliente, tutoriais interativos e outros serviços digitais.
Avatar responde enquanto a conversa acontece
O Live Avatar combina o modelo de diálogo em tempo real com geração de vídeo de baixa latência.
O sistema consegue produzir vídeo sincronizado com a fala a 24 quadros por segundo. Os movimentos dos lábios e as expressões faciais acompanham o áudio enquanto a conversa acontece.
A proposta é tornar a interação mais natural. O usuário pode conversar com o agente enquanto ele também analisa informações visuais e executa determinadas tarefas em segundo plano.
Isso permite, por exemplo, que um agente consulte dados ou acione ferramentas sem interromper completamente a conversa.
Tecnologia funciona em 97 idiomas
Outro destaque está no suporte multilíngue.
Segundo o Google, o Live Avatar consegue adaptar a fala, a sincronização labial e as expressões quando a conversa muda de idioma. O recurso oferece suporte a 97 idiomas.
A empresa também afirma que a mudança entre idiomas pode ocorrer durante a própria conversa sem comprometer a sincronização visual do avatar.
É possível criar avatares personalizados
O sistema também permite trabalhar com personagens visuais diferentes.
Há uma biblioteca de avatares prontos, mas empresas podem solicitar acesso à criação de personagens personalizados. Nesse caso, uma imagem de referência pode ser usada para gerar um avatar animado mantendo características visuais do modelo fornecido.
O recurso personalizado possui controles adicionais. O acesso depende de autorização e existem exigências relacionadas ao uso de imagens e amostras de voz.
As orientações de configuração também proíbem o uso de imagens de menores e estabelecem restrições para determinados tipos de referência.
Conteúdo gerado recebe marca d’água
O Google também incluiu mecanismos para facilitar a identificação de conteúdo produzido pela inteligência artificial.
Os fluxos de áudio e vídeo gerados pelo Live Avatar recebem uma marca d’água invisível baseada na tecnologia SynthID. A ideia é ajudar na identificação e reduzir o risco de atribuição incorreta do material.
Recurso chega primeiro às empresas
O Gemini 3.8 Live com Live Avatar foi disponibilizado em 24 de setembro de 2026 para o Gemini Enterprise.
Isso significa que a novidade não representa, neste momento, uma atualização geral do aplicativo Gemini para consumidores. O foco inicial está em empresas que pretendem utilizar agentes de atendimento, assistentes virtuais e experiências interativas.
A tecnologia mostra uma mudança importante na forma como os assistentes de inteligência artificial podem se apresentar. Em vez de simplesmente ouvir uma voz sintética, o usuário passa a interagir com um personagem capaz de falar, olhar e reagir visualmente em tempo real.
Veja mais sobre web.