O Google anunciou o Gemini 3.8 Live com Live Avatar, novidade que adiciona uma representação visual em tempo real às conversas com a inteligência artificial. O recurso usa diálogo por voz e transmissão de vídeo de baixa latência para exibir um avatar que consegue falar, movimentar os lábios e reagir durante a interação.
A tecnologia processa entradas de áudio e vídeo simultaneamente para manter conversas mais naturais. Os avatares contam com sincronização labial, expressões faciais e alternância de turnos durante o diálogo. A IA também consegue executar tarefas em segundo plano sem interromper a conversa.
O Live Avatar também foi desenvolvido para uso em diferentes idiomas. O sistema suporta 97 línguas e mantém a sincronização entre fala e movimentos do avatar mesmo quando o idioma muda durante a conversa. Todo o conteúdo gerado pelo recurso, incluindo áudio e vídeo, recebe a marca d'água SynthID. A tecnologia fica incorporada ao material produzido por IA e serve para ajudar na identificação desse tipo de conteúdo.
Os avatares em vídeo estão disponíveis para quem?
O Gemini 3.8 Live com Live Avatar está disponível inicialmente para usuários do Gemini Enterprise. As empresas que utilizam a plataforma podem recorrer à documentação da API para integrar os avatares a serviços próprios, como atendimento ao cliente e tutoriais interativos.
O Google oferece diferentes opções de personalização.
