O Google apresentou o Gemini 3.8 Live com Live Avatar, recurso que adiciona uma persona animada às conversas com usuários. A novidade foi anunciada nesta quinta-feira (24) e já está disponível no Gemini Enterprise.
O avatar fala, reage com expressões faciais e sincroniza os movimentos da boca com o áudio em tempo quase real. A tecnologia combina geração de vídeo de baixa latência com os recursos de diálogo ao vivo do Gemini, que passa a oferecer uma presença visual além das respostas por voz.
O sistema foi desenvolvido para aplicações empresariais, como atendimento ao cliente e experiências interativas. Durante a conversa, também consegue processar informações visuais e de áudio simultaneamente, exibir dados na tela e executar ferramentas em segundo plano sem interromper o diálogo.
Idiomas e avatares personalizados
O Live Avatar pode alternar entre 97 idiomas, mantendo a sincronização labial e as expressões faciais. Em uma demonstração do Google, o mesmo avatar conversou em inglês e japonês com movimentos da boca correspondentes às falas nos dois idiomas.
A empresa cita como exemplo o atendimento a um hóspede durante o check-in de um hotel. Nesse cenário, o avatar pode manter a conversa enquanto aciona ferramentas para realizar tarefas.
As organizações podem escolher avatares prontos ou criar personagens personalizados a partir de uma imagem de referência. A alternativa permite preservar características visuais, a identidade de um personagem ou elementos de uma marca. Por enquanto, a criação personalizada está restrita a uma lista de empresas autorizadas.
O Google afirma ainda que os conteúdos gerados por seus produtos de inteligência artificial recebem a marca d’água invisível SynthID, incorporada ao áudio e ao vídeo para ajudar a identificar material criado por IA.
Gemini 4 entra na fase de refinamento
Enquanto amplia o Gemini 3.8, o Google prepara o Gemini 4. Segundo Koray Kavukcuoglu, chefe do Google DeepMind, o modelo está em fase de refinamento e deve ser lançado muito antes do fim de 2026.
Kavukcuoglu afirmou que a empresa pretende disponibilizar uma primeira versão após o treinamento final o mais rápido possível. O estágio de pós-treinamento inclui o refinamento do comportamento do modelo, testes internos e a implementação de mecanismos de segurança.
O Gemini 4 representa a próxima etapa da família de modelos, enquanto o Gemini 3.8 Live já combina conversas em tempo quase real, processamento de informações visuais, suporte a 97 idiomas e execução de ferramentas em segundo plano. Com o Live Avatar, o Google acrescenta expressões faciais e sincronização labial à interação.







