Mundo Geek Web

Google Gemini 3.8 Live ganha avatares que conversam em tempo real

O Google apresentou o Gemini 3.8 Live com Live Avatar, uma tecnologia que adiciona uma presença visual às conversas com inteligência artificial.

Em vez de responder apenas por voz ou texto, o sistema gera um avatar animado capaz de falar, movimentar os lábios e reagir com expressões faciais durante a conversa.

A tecnologia foi criada principalmente para aplicações empresariais, como atendimento ao cliente, tutoriais interativos e outros serviços digitais.

Avatar responde enquanto a conversa acontece

O Live Avatar combina o modelo de diálogo em tempo real com geração de vídeo de baixa latência.

O sistema consegue produzir vídeo sincronizado com a fala a 24 quadros por segundo. Os movimentos dos lábios e as expressões faciais acompanham o áudio enquanto a conversa acontece.

A proposta é tornar a interação mais natural. O usuário pode conversar com o agente enquanto ele também analisa informações visuais e executa determinadas tarefas em segundo plano.

Isso permite, por exemplo, que um agente consulte dados ou acione ferramentas sem interromper completamente a conversa.

Tecnologia funciona em 97 idiomas

Outro destaque está no suporte multilíngue.

Segundo o Google, o Live Avatar consegue adaptar a fala, a sincronização labial e as expressões quando a conversa muda de idioma. O recurso oferece suporte a 97 idiomas.

A empresa também afirma que a mudança entre idiomas pode ocorrer durante a própria conversa sem comprometer a sincronização visual do avatar.

É possível criar avatares personalizados

O sistema também permite trabalhar com personagens visuais diferentes.

Há uma biblioteca de avatares prontos, mas empresas podem solicitar acesso à criação de personagens personalizados. Nesse caso, uma imagem de referência pode ser usada para gerar um avatar animado mantendo características visuais do modelo fornecido.

O recurso personalizado possui controles adicionais. O acesso depende de autorização e existem exigências relacionadas ao uso de imagens e amostras de voz.

As orientações de configuração também proíbem o uso de imagens de menores e estabelecem restrições para determinados tipos de referência.

Conteúdo gerado recebe marca d’água

O Google também incluiu mecanismos para facilitar a identificação de conteúdo produzido pela inteligência artificial.

Os fluxos de áudio e vídeo gerados pelo Live Avatar recebem uma marca d’água invisível baseada na tecnologia SynthID. A ideia é ajudar na identificação e reduzir o risco de atribuição incorreta do material.

Recurso chega primeiro às empresas

O Gemini 3.8 Live com Live Avatar foi disponibilizado em 24 de setembro de 2026 para o Gemini Enterprise.

Isso significa que a novidade não representa, neste momento, uma atualização geral do aplicativo Gemini para consumidores. O foco inicial está em empresas que pretendem utilizar agentes de atendimento, assistentes virtuais e experiências interativas.

A tecnologia mostra uma mudança importante na forma como os assistentes de inteligência artificial podem se apresentar. Em vez de simplesmente ouvir uma voz sintética, o usuário passa a interagir com um personagem capaz de falar, olhar e reagir visualmente em tempo real.

Veja mais sobre web.

Jornalista há mais de 20 anos e fundador do NERDIZMO. Foi editor do GamesBrasil, TechGuru, BABOO e já forneceu conteúdo para os principais portais do Brasil, como o UOL, GLOBO, MSN, TERRA, iG e R7. Também foi repórter das revistas MOVIE, EGW e Nintendo World.

Inscrever-se
Notificar de
guest

0 Comentários
mais antigos
mais recentes Mais votado
Pin