O Google apresentou dois modelos de inteligência artificial voltados à interação por voz: o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking. As ferramentas foram anunciadas nesta terça-feira (15) e já começaram a ser liberadas para desenvolvedores, empresas e usuários finais em diferentes produtos da companhia.
Dois modelos, funções distintas
O Gemini 3.8 Live foi desenvolvido para conversas em maior escala, com foco em eficiência. A ferramenta consegue acionar recursos externos e fazer chamadas de API enquanto mantém o diálogo com o usuário. Também pode interpretar dados visuais enviados por câmeras e outras fontes quase em tempo real, usando esse conteúdo na conversa.
Durante uma interação, o sistema pode reconhecer um pedido, iniciar a execução e continuar respondendo por voz. O modelo também alterna automaticamente entre 97 idiomas. Segundo o Google, o Gemini 3.8 Live ficou em segundo lugar na avaliação de usuários do Speech Agent Arena, que mede o desempenho de sistemas de voz.
O Gemini 3.8 Live Extended Thinking foi projetado para tarefas que exigem raciocínio mais avançado e várias etapas de processamento. A tecnologia pode falar e raciocinar ao mesmo tempo, mantendo a interação enquanto realiza trabalhos mais longos. O sistema ainda consegue informar o andamento da atividade e usar frases como “deixe-me verificar isso para você” enquanto executa as etapas necessárias.
Uso em produtos e resultados
O Google também anunciou a aplicação do modelo em serviços do Workspace. O Docs Live permitirá comandos de voz para tarefas no Google Docs; recursos semelhantes serão usados no Gmail Live e no Keep Live. A tecnologia também será incorporada ao Search Live, com orientação em tempo real e instruções passo a passo.
Nos testes divulgados pela empresa, o Gemini 3.8 Live Extended Thinking alcançou 82,6 pontos e ficou em primeiro lugar geral no Speech to Speech Quality Index, da Artificial Analysis. No τ-Voice, voltado à execução de tarefas por agentes, obteve 68,6%. No τ-Voice-banking, direcionado a atividades do setor financeiro, marcou 35,1%.
O Gemini 3.8 Live está disponível para desenvolvedores pela Gemini API e pelo Google AI Studio. Empresas podem acessá-lo em uma prévia privada do Gemini Enterprise, enquanto usuários comuns podem utilizar o modelo no Search Live. A versão Extended Thinking também chegou à Gemini API e ao Google AI Studio, além de estar em prévia privada no Gemini Enterprise.
Para o público final, o recurso está sendo incorporado ao aplicativo Gemini e ao Workspace. O Docs Live é oferecido a assinantes do Google AI Pro e do Google AI Ultra. Já Gmail Live e Keep Live estão disponíveis para clientes dos planos Google AI Plus, Google AI Pro e Google AI Ultra.







