Google lança avatar inteligente que fala, reage e sincroniza movimentos em tempo real
Tecnologia promete transformar atendimentos empresariais com avatares visuais interativos
A nova inteligência artificial do Google, chamada Gemini, apresenta um avatar que fala, reage a emoções e mantém uma conversa natural, integrando vídeos de baixa latência e diálogo ao vivo.
Na mais recente inovação em inteligência artificial, o Google anunciou nesta quinta-feira (24) o lançamento do Gemini Live Avatar, uma tecnologia que combina uma representação visual com fala interativa em tempo real. Segundo fontes da própria companhia, essa novidade é voltada principalmente para aplicações empresariais, como atendimento ao cliente e experiências interativas, oferecendo uma presença visual que acompanha a conversa de forma mais natural e envolvente.
O sistema utiliza geração de vídeo de baixa latência aliado ao diálogo ao vivo, permitindo que o avatar não apenas responda por voz, mas também sincronize seus movimentos de lábios, apresente diferentes expressões faciais e mantenha uma postura mais convincente durante o contato. Ainda de acordo com o Google, o avatar pode adotar diversos personagens já prontos ou ser personalizado por empresas, que podem criar avatares a partir de imagens de referência, preservando características específicas ou elementos de marca. Contudo, essa personalização está atualmente limitada a uma lista de empresas autorizadas, além de ser uma funcionalidade ainda em fase de implementação.
Para garantir a autenticidade e a rastreabilidade do conteúdo, o Google afirma que toda produção de IA conta com uma marca d’água invisível chamada SynthID, incorporada ao áudio e ao vídeo, o que ajuda a identificar materiais gerados pelo sistema. A novidade chega num momento em que a companhia prepara o lançamento de uma versão mais avançada de seu modelo de IA, o Gemini 4, que ainda está em fase de aprimoramento e deve ser lançado “muito antes” do final de 2026. Segundo o chefe do Google DeepMind, a intenção é partir rapidamente para o lançamento do primeiro modelo pós-treinamento, já que os resultados atuais têm sido considerados promissores.
O desenvolvimento do Gemini 4 já entrou na etapa de pós-treinamento, quando o comportamento do sistema é ajustado por testes internos e implementação de mecanismos de segurança, preparando-se para o lançamento oficial. Essa fase é vista como fundamental para garantir a confiabilidade do sistema, sobretudo diante do avanço contínuo na tecnologia de IA pelo Google, que pretende manter sua posição na linha de frente do setor, mesmo com a crescente competição internacional. Ainda não há confirmação oficial de uma data exata de lançamento, mas o que se sabe é que o projeto está avançando com rapidez e que a expectativa é de novidades em breve.
Enquanto isso, o modelo Gemini 3.8, voltado para diálogos quase instantâneos e com capacidade de processar informações visuais e múltiplos idiomas — até 97 —, continua expandindo suas funcionalidades, incluindo a execução de ferramentas em segundo plano durante as conversas. A tecnologia, segundo fontes, representa um passo importante para o futuro da interação entre humanos e inteligência artificial, com aplicação principalmente em áreas comerciais e de entretenimento digital.
O que sabemos?
- O Google lançou nesta quinta-feira (24) o Gemini Live Avatar, uma IA que fala, reage, sincroniza os lábios e apresenta expressões faciais.
- O sistema combina geração de vídeo de baixa latência com diálogo ao vivo, permitindo uma interação mais natural.
- Avatares podem ser personalizados a partir de imagens de referência, porém essa funcionalidade está limitada a empresas autorizadas.
- Toda produção de conteúdo pelo sistema possui uma marca d’água invisível chamada SynthID para garantir rastreabilidade.
- O Gemini 4, versão mais avançada, está em fase de pós-treinamento e deve ser lançado antes do fim de 2026.
Fontes
- Olhar Digital fonte especializada





