São Paulo, Quinta-feira, 1 de outubro de 2026
Tecnologia

Google leva avatar animado ao Gemini para conversas em tempo quase real

Recurso combina voz, vídeo, expressões faciais e sincronização labial em 97 idiomas para aplicações empresariais.

Google leva avatar animado ao Gemini para conversas em tempo quase real
Foto: Reprodução/Google

O Google apresentou o Gemini 3.8 Live com Live Avatar, recurso que adiciona uma persona animada às conversas com usuários. A novidade foi anunciada nesta quinta-feira (24) e já está disponível no Gemini Enterprise.

O avatar fala, reage com expressões faciais e sincroniza os movimentos da boca com o áudio em tempo quase real. A tecnologia combina geração de vídeo de baixa latência com os recursos de diálogo ao vivo do Gemini, que passa a oferecer uma presença visual além das respostas por voz.

O sistema foi desenvolvido para aplicações empresariais, como atendimento ao cliente e experiências interativas. Durante a conversa, também consegue processar informações visuais e de áudio simultaneamente, exibir dados na tela e executar ferramentas em segundo plano sem interromper o diálogo.

Idiomas e avatares personalizados

O Live Avatar pode alternar entre 97 idiomas, mantendo a sincronização labial e as expressões faciais. Em uma demonstração do Google, o mesmo avatar conversou em inglês e japonês com movimentos da boca correspondentes às falas nos dois idiomas.

A empresa cita como exemplo o atendimento a um hóspede durante o check-in de um hotel. Nesse cenário, o avatar pode manter a conversa enquanto aciona ferramentas para realizar tarefas.

As organizações podem escolher avatares prontos ou criar personagens personalizados a partir de uma imagem de referência. A alternativa permite preservar características visuais, a identidade de um personagem ou elementos de uma marca. Por enquanto, a criação personalizada está restrita a uma lista de empresas autorizadas.

O Google afirma ainda que os conteúdos gerados por seus produtos de inteligência artificial recebem a marca d’água invisível SynthID, incorporada ao áudio e ao vídeo para ajudar a identificar material criado por IA.

Gemini 4 entra na fase de refinamento

Enquanto amplia o Gemini 3.8, o Google prepara o Gemini 4. Segundo Koray Kavukcuoglu, chefe do Google DeepMind, o modelo está em fase de refinamento e deve ser lançado muito antes do fim de 2026.

Kavukcuoglu afirmou que a empresa pretende disponibilizar uma primeira versão após o treinamento final o mais rápido possível. O estágio de pós-treinamento inclui o refinamento do comportamento do modelo, testes internos e a implementação de mecanismos de segurança.

O Gemini 4 representa a próxima etapa da família de modelos, enquanto o Gemini 3.8 Live já combina conversas em tempo quase real, processamento de informações visuais, suporte a 97 idiomas e execução de ferramentas em segundo plano. Com o Live Avatar, o Google acrescenta expressões faciais e sincronização labial à interação.

Texto produzido pela Redação Mapa do Mercado com apoio de inteligência artificial a partir de fontes públicas, com revisão editorial. Erros? Fale conosco.

Entre na nossa newsletterO melhor da semana, sem spam.

Em alta

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5